ConfidenceBench: Evaluating Confidence Calibration in Large Language Models

arXiv:2607.20526 · cs.AI, cs.LG, stat.ML · Submitted 2026-07-10 · Read on arXiv

Matthew ffrench-Constant, Daniel Yang, Xinmeng Huang, Sanyam Kapoor

cs.AI, cs.LG, stat.ML

Submitted: 2026-07-10

License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/

Terminology

Sources

Related papers