Towards Weaker Variance Assumptions for Stochastic Optimization
math.OC, cs.LG, stat.ML
Submitted: 2025-04-14
Updated: 2026-09-26
Terminology
Sources
- Handbook of Convergence Theorems for (Stochastic) Gradient Methods
- High-Probability Convergence for Composite and Distributed Stochastic Minimization and Variational Inequalities with Heavy-Tailed Noise
- Accelerated stochastic approximation with state-dependent noise
- Convergence Rates for Stochastic Approximation: Biased Noise with Unbounded Variance, and Applications
- Improved Convergence in High Probability of Clipped Gradient Methods with Heavy Tails
- Accelerated Minimax Algorithms Flock Together
- Randomized Coordinate Subgradient Method for Nonsmooth Composite Optimization
Related papers
- Lions and Muons: Optimization via Stochastic Frank-Wolfe under Heavy-Tailed Noise
- Adam-HNAG: A Convergent Reformulation of Adam with Accelerated Rate
- Incremental Learning in Mirror Flows
- Online Control via Counterfactual Tracking
- Asynchronous Replanning in Two Population Linear Quadratic Mean Field Games: Information Requirements and Stability
- Petrov-Galerkin operator inference with application to stability-encouraging identification