BIRD: Distilling Decision Boundaries into Rationales for MLLM Adaptation
cs.AI
Submitted: 2026-09-27
Updated: 2026-09-27
Terminology
Sources
- OpenMedReason: Scientific Reasoning Supervision for Medical Vision-Language Models
- ChartQA-X: Generating Explanations for Visual Chart Reasoning
- Med-Scout: Curing MLLMs' Geometric Blindness in Medical Perception via Geometry-Aware RL Post-Training
- Diving into Self-Evolving Training for Multimodal Reasoning
- Through the Lens of Contrast: Self-Improving Visual Reasoning in VLMs
- Improving Reasoning in Vision-Language Models via Perception Verified Self-Training
- Kimi K3: Open Frontier Intelligence
- Towards Rationale-Answer Alignment of LVLMs via Self-Rationale Calibration
- Retrieving Counterfactuals Improves Visual In-Context Learning
- ChartBench: A Benchmark for Complex Visual Reasoning in Charts
- Do Medical Vision Language Models Actually See? A Counterfactual Grounding Framework and Hard-Negative Contrastive Training for Visually-Reliant Medical VLMs
- InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models
- MedXpertQA: Benchmarking Expert-Level Medical Reasoning and Understanding
Related papers
- MAVEN-T: Reinforced Heterogeneous Distillation for Real-Time Multi-Agent Trajectory Prediction
- Model Discovery Agent: LLM-assisted Bayesian experiment design for data-efficient discovery of mechanistic world models
- The Clinician's Veto: Navigating Trust, Liability, and Uncertainty in Autonomous AI Prescribing
- MindHelper: Closed-Loop Embodied Mental-State Reasoning for Precision Intervention
- Incumbent Advantage: Brand Bias and Cognitive Manipulation Dynamics in LLM Recommendation Systems
- VSAL: A Vision Solver with Adaptive Layouts for Graph Property Detection