Distributionally Robust Average-Reward Reinforcement Learning: Finite-Sample Guarantees under Weak Communication

arXiv:2609.32727 · cs.LG, math.OC, stat.ML · Submitted 2026-09-26 · Read on arXiv

cs.LG, math.OC, stat.ML

Submitted: 2026-09-26

Updated: 2026-09-26

Terminology

Sources

Related papers