HarnessBandit: Joint Learnability-Transferability Scheduling for Multi-Harness Agentic Reinforcement Learning

arXiv:2609.13739 · cs.LG, cs.AI, cs.CL · Submitted 2026-09-12 · Read on arXiv

cs.LG, cs.AI, cs.CL

Submitted: 2026-09-12

Updated: 2026-09-12

Comments: 13 pages. Equal contribution: Hongliang Wei and Xiaobing Tu. Corresponding authors: Xiaobing Tu and Xiaopeng Fan

License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/

Terminology

Related papers