A rubric landscape for evaluating clinical reasoning in large language models: what exists, what is missing, and what needs to be combined

arXiv:2610.01938 · cs.CL, cs.AI · Submitted 2026-10-01 · Read on arXiv

cs.CL, cs.AI

Submitted: 2026-10-01

Updated: 2026-10-01

Terminology

Sources

Related papers