Multi-step Proximal Policy Improvement in Offline Reinforcement Learning

arXiv:2609.03842 · cs.LG · Submitted 2026-09-03 · Read on arXiv

cs.LG

Submitted: 2026-09-03

Updated: 2026-09-03

Terminology

Sources

Related papers