Program Learning with Verifiable Rewards: Symbolic Backpropagation for Post-Training LLMs

arXiv:2608.28421 · cs.AI · Submitted 2026-08-28 · Read on arXiv

cs.AI

Submitted: 2026-08-28

Updated: 2026-08-28

Terminology

Related papers