Training Dynamics and Induced Preconditioning of ReLU Policy Gradient for Scalar LQR
math.OC, cs.SY, eess.SY
Submitted: 2026-04-24
Updated: 2026-09-25
Terminology
Sources
- Sample-Efficient Model-Free Policy Gradient Methods for Stochastic LQR via Robust Linear Regression
- Policy Gradient Adaptive Control for the LQR: Indirect and Direct Approaches
Related papers
- Lions and Muons: Optimization via Stochastic Frank-Wolfe under Heavy-Tailed Noise
- Adam-HNAG: A Convergent Reformulation of Adam with Accelerated Rate
- Incremental Learning in Mirror Flows
- Online Control via Counterfactual Tracking
- Asynchronous Replanning in Two Population Linear Quadratic Mean Field Games: Information Requirements and Stability
- Petrov-Galerkin operator inference with application to stability-encouraging identification