Cited but Not Consulted: A Counterfactual Audit of Legal Chain-of-Thought Faithfulness
cs.AI, cs.CL, cs.CY
Submitted: 2026-10-08
Updated: 2026-10-08
Terminology
Sources
- Eliciting Latent Predictions from Transformers with the Tuned Lens
- LegalCiteBench: Evaluating Citation Reliability in Legal Language Models
- Legal$\Delta$: Enhancing Legal Reasoning in LLMs via Reinforcement Learning with Chain-of-Thought Guided Information Gain
- Measuring Faithfulness in Chain-of-Thought Reasoning
- Who Checks the Citations? Benchmarking Legal Hallucination Detection
- When Agents Commit Too Soon: Diagnosing Premature Commitment in LLM Agents
- Citation Grounding Measures the Oracle: Graph Coverage Determines Reported LLM Hallucination Rates in Law
- Beyond the Commitment Boundary: Probing Epiphenomenal Chain-of-Thought in Large Reasoning Models
- Breaking the Chain: A Causal Analysis of LLM Faithfulness to Intermediate Structures
- Know Your Limits : On the Faithfulness of LLMs as Solvers and Autoformalizers in Legal Reasoning
- When Does a Language Model Commit? A Finite-Answer Theory of Pre-Verbalization Commitment
Related papers
- MAVEN-T: Reinforced Heterogeneous Distillation for Real-Time Multi-Agent Trajectory Prediction
- Model Discovery Agent: LLM-assisted Bayesian experiment design for data-efficient discovery of mechanistic world models
- The Clinician's Veto: Navigating Trust, Liability, and Uncertainty in Autonomous AI Prescribing
- MindHelper: Closed-Loop Embodied Mental-State Reasoning for Precision Intervention
- Incumbent Advantage: Brand Bias and Cognitive Manipulation Dynamics in LLM Recommendation Systems
- VSAL: A Vision Solver with Adaptive Layouts for Graph Property Detection