Just-In-Time Reinforcement Learning: Continual Learning in LLM Agents Without Gradient Updates

arXiv:2601.18510 · cs.LG, cs.AI · Submitted 2026-01-26 · Read on arXiv

cs.LG, cs.AI

Submitted: 2026-01-26

Updated: 2026-09-27

Code: https://github.com/liushiliushi/JitRL

Terminology

Sources

Related papers