On the Limits of Metacognitive Monitoring in LLMs
cs.AI, q-bio.NC
Submitted: 2026-09-28
Updated: 2026-09-28
Code: https://github.com/huggingface/Mat
Terminology
Sources
- When Does Combining Language Models Help? A Co-Failure Ceiling on Routing, Voting, and Mixture-of-Agents Across 67 Frontier Models
- Do LLM Evaluators Prefer Themselves for a Reason?
- Unsolvability Ceiling in Multi-LLM Routing: An Empirical Study of Evaluation Artifacts
- Language Models (Mostly) Know What They Know
- No Free Labels: Limitations of LLM-as-a-Judge Without Human Grounding
- Semantic Uncertainty: Linguistic Invariances for Uncertainty Estimation in Natural Language Generation
- Self-Preference Bias in LLM-as-a-Judge
Related papers
- MAVEN-T: Reinforced Heterogeneous Distillation for Real-Time Multi-Agent Trajectory Prediction
- Model Discovery Agent: LLM-assisted Bayesian experiment design for data-efficient discovery of mechanistic world models
- The Clinician's Veto: Navigating Trust, Liability, and Uncertainty in Autonomous AI Prescribing
- MindHelper: Closed-Loop Embodied Mental-State Reasoning for Precision Intervention
- Incumbent Advantage: Brand Bias and Cognitive Manipulation Dynamics in LLM Recommendation Systems
- VSAL: A Vision Solver with Adaptive Layouts for Graph Property Detection