Can Language Models Learn to Reject Their Own Bad Reasoning Steps?

arXiv:2610.05976 · cs.CL · Submitted 2026-10-05 · Read on arXiv

cs.CL

Submitted: 2026-10-05

Updated: 2026-10-05

Related papers