EndoCogniAgent: Closed-Loop Agentic Reasoning with Self-Consistency Validation for Endoscopic Diagnosis
cs.AI, cs.CL, cs.CV
Submitted: 2025-08-10
Updated: 2026-09-22
Comments: 21 pages, 24 figures, 9 tables. Revised version: adds a blinded clinician evaluation, paired statistical significance testing, and extended ablation and generalization analyses. Code and data are available at https://github.com/Tyyds-ai/EndoCogniAgent
Code: https://github.com/Tyyds-ai/EndoCogniAgent
License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
Terminology
Sources
- How Do Medical MLLMs Fail? A Study on Visual Grounding in Medical Images
- MedMMV: A Controllable Multimodal Multi-Agent Framework for Reliable and Verifiable Clinical Reasoning
- AgentEHR: Advancing Autonomous Clinical Decision-Making via Retrospective Summarization
- Why Do Multi-Agent LLM Systems Fail?
- EndoDINO: A Foundation Model for GI Endoscopy
- Frontiers in Intelligent Colonoscopy
- MedHEval: Benchmarking Hallucinations and Mitigation Strategies in Medical Large Vision-Language Models
- MMedAgent: Learning to Use Medical Tools with Multi-modal Agent
- MedOrch: Medical Diagnosis with Tool-Augmented Reasoning Agents for Flexible Extensibility
- MedRAX: Medical Reasoning Agent for Chest X-ray
- CARE: Towards Clinical Accountability in Multi-Modal Medical Reasoning with an Evidence-Grounded Agentic Framework
- MedAgent-Pro: Towards Evidence-based Multi-modal Medical Diagnosis via Reasoning Agentic Workflow
- AgentClinic: a multimodal agent benchmark to evaluate AI in simulated clinical environments
- EndoBench: A Comprehensive Evaluation of Multi-Modal Large Language Models for Endoscopy Analysis
- Universal Medical Image Representation Learning with Compositional Decoders
- Polyp-Gen: Realistic and Diverse Polyp Image Generation for Endoscopic Dataset Expansion
- Self-Consistency Improves Chain of Thought Reasoning in Language Models
- MedMax: Mixed-Modal Instruction Tuning for Training Biomedical Assistants
- Yi: Open Foundation Models by 01.AI
- GPT-4o System Card
Related papers
- MAVEN-T: Reinforced Heterogeneous Distillation for Real-Time Multi-Agent Trajectory Prediction
- Model Discovery Agent: LLM-assisted Bayesian experiment design for data-efficient discovery of mechanistic world models
- The Clinician's Veto: Navigating Trust, Liability, and Uncertainty in Autonomous AI Prescribing
- MindHelper: Closed-Loop Embodied Mental-State Reasoning for Precision Intervention
- Incumbent Advantage: Brand Bias and Cognitive Manipulation Dynamics in LLM Recommendation Systems
- VSAL: A Vision Solver with Adaptive Layouts for Graph Property Detection