Test-Time Scaling in Reasoning LLMs: Inference Regimes, Evaluation, and Reproducibility

arXiv:2608.04001 · cs.LG, cs.AI · Submitted 2026-08-04 · Read on arXiv

cs.LG, cs.AI

Submitted: 2026-08-04

Updated: 2026-08-31

Code: https://github.com/bespokelabsai/curator

Project page: https://mohsenhariri.github.io/scorio/ttshttps://huggingface.co/datasets/harimo/scorio

Terminology

Sources

Related papers