From Given to Gathered Evidence: Agentic Learning for Longitudinal Medical Reasoning
cs.CV
Submitted: 2026-09-30
Updated: 2026-09-30
Terminology
Sources
- Qwen3-VL Technical Report
- UKBOB: One Billion MRI Labeled Masks for Generalizable 3D Medical Image Segmentation
- DeepSeek-V4: Towards Highly Efficient Million-Token Context Intelligence
- Evolving Medical Imaging Agents via Experience-driven Self-skill Discovery
- Reinforcement Learning via Self-Distillation
- Ophiuchus: Incentivizing Tool-augmented "Think with Images" for Joint Medical Segmentation, Understanding and Reasoning
- MedAgentBench: A Realistic Virtual EHR Environment to Benchmark Medical LLM Agents
- What Disease does this Patient Have? A Large-scale Open Domain Question Answering Dataset from Medical Exams
- On-policy Distillation with Verifiable Reward
- Teacher-Guided Policy Optimization for On-Policy Reasoning Distillation under Large Policy Divergence
- ClinEnv: An Interactive Multi-Stage Long Horizon EHR Environment for Agents
- Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases
- AgentClinic: a multimodal agent benchmark to evaluate AI in simulated clinical environments
- Proximal Policy Optimization Algorithms
- MedGemma Technical Report
- MedGemma 1.5 Technical Report
- DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models
- Self-Supervised On-Policy Distillation for Reasoning Language Models
- PBSD: Privileged Bayesian Self-Distillation for Long-Horizon Credit Assignment
- TRACE: Distilling Where It Matters via Token-Routed Self On-Policy Alignment
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models