Reporting Practice Matters: The Impact of Reference Choice on Chest X-ray Report Evaluation
cs.CL, cs.AI
Submitted: 2026-09-16
Updated: 2026-09-16
Comments: Preprint
Code: https://github.com/taekb/rrg-reref
License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
Terminology
Sources
- CheXpert Plus: Augmenting a Large Chest X-ray Dataset with Text Radiology Reports, Patient Demographics and Additional Image Formats
- Scaling medical imaging report generation with multimodal reinforcement learning
- Lunguage: A Benchmark for Structured and Sequential Chest X-ray Interpretation
- Llama 2: Open Foundation and Fine-Tuned Chat Models
- BERTScore: Evaluating Text Generation with BERT
- Towards a clinically accessible radiology foundation model: open-access and lightweight, with automated evaluation
- MedVersa: A Generalist Foundation Model for Medical Image Interpretation
Related papers
- Exploring Solution Divergence and Its Effect on Large Language Model Problem Solving
- Ishigaki-IDS-Bench: A Benchmark for Generating Information Delivery Specification from BIM Information Requirements
- Subliminal Steering: Stronger Encoding of Hidden Signals
- MedStruct-S: A Benchmark for Key Discovery, Key-Conditioned QA and Semi-Structured Extraction from OCR Clinical Reports
- The End of Transformers? On Challenging Attention and the Rise of Sub-Quadratic Architectures
- Untangling the Mechanisms of Misleading Context in Medical Question Answering