High-Probability Guarantees for SGD under beta-Heavy-Tailed Gradient Noise
stat.ML, cs.LG
Submitted: 2026-09-26
Updated: 2026-09-26
Terminology
Sources
- Adam: A Method for Stochastic Optimization
- Revisiting the Last-Iterate Convergence of Stochastic Gradient Methods
- Nonconvex Stochastic Optimization under Heavy-Tailed Noises: Optimal Convergence without Gradient Clipping
Related papers
- Behavior of prediction performance metrics with rare events
- Optimal Estimation of Generic Dynamics by Path-Dependent Neural Jump ODEs
- A Posterior-Dynamics Framework for Imaging Inverse Problems with Pretrained Diffusion Priors
- One Permutation Is All You Need: Fast, Deterministic Feature Importance and Model Stress-Testing
- Online Conformal Prediction for Non-Exchangeable Panel Data
- Deep Time-Series Forecasting in 10 Years: A Survey