Optimal Rates of Convergence for Entropy Regularization in Discounted Markov Decision Processes
math.OC, cs.LG, cs.SY, eess.SY
Submitted: 2024-06-06
Updated: 2026-09-10
Comments: 32 pages, 1 figure
Journal ref: Information and Inference: A Journal of the IMA, Volume 15, Issue 1, March 2026, iaaf034
License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
Terminology
Sources
- A Geometric Embedding Approach to Multiple Games and Multiple Populations
- Elementary Analysis of Policy Gradient Methods
- A unified view of entropy-regularized Markov decision processes
Related papers
- Lions and Muons: Optimization via Stochastic Frank-Wolfe under Heavy-Tailed Noise
- Adam-HNAG: A Convergent Reformulation of Adam with Accelerated Rate
- Incremental Learning in Mirror Flows
- Online Control via Counterfactual Tracking
- Asynchronous Replanning in Two Population Linear Quadratic Mean Field Games: Information Requirements and Stability
- Petrov-Galerkin operator inference with application to stability-encouraging identification