Near-Optimal Primal-Dual Algorithm for Learning Linear Mixture CMDPs with Adversarial Rewards

arXiv:2603.27884 · cs.LG, math.OC · Submitted 2026-03-29 · Read on arXiv

cs.LG, math.OC

Submitted: 2026-03-29

Updated: 2026-09-18

Code: https://github.com/kihyun-yu/pd-powers

License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/

Terminology

Sources

Related papers