Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning
Zijie Cheng, Yang Peng, Zhihua Zhang
stat.ML, cs.LG
Submitted: 2026-07-09
License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
Terminology
Sources
- Quantile QT-Opt for Risk-Aware Vision-Based Robotic Grasping
- GAN Q-learning
- Online Statistical Inference for Nonlinear Stochastic Approximation with Markovian Data
- Training language models to follow instructions with human feedback
- A Finite Sample Analysis of Distributional TD Learning with Linear Function Approximation
- An Analysis of Quantile Temporal-Difference Learning
- Distributional Offline Policy Evaluation with Predictive Error Guarantees
Related papers
- Behavior of prediction performance metrics with rare events
- Optimal Estimation of Generic Dynamics by Path-Dependent Neural Jump ODEs
- A Posterior-Dynamics Framework for Imaging Inverse Problems with Pretrained Diffusion Priors
- One Permutation Is All You Need: Fast, Deterministic Feature Importance and Model Stress-Testing
- Online Conformal Prediction for Non-Exchangeable Panel Data
- Deep Time-Series Forecasting in 10 Years: A Survey