DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Agent Memory

arXiv:2605.22411 · cs.CL, cs.AI, cs.LG · Submitted 2026-05-21 · Read on arXiv

cs.CL, cs.AI, cs.LG

Submitted: 2026-05-21

Updated: 2026-09-27

Code: https://github.com/huggingface/trl

Terminology

Sources

Related papers