Monitorable Chart Reasoning Agents via Verifiable Process Rewards
cs.CV
Submitted: 2026-09-21
Updated: 2026-09-21
Code: https://github.com/sanchit97/chartrl
Terminology
Sources
- ChartQA-X: Generating Explanations for Visual Chart Reasoning
- Qwen2.5-VL Technical Report
- Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling
- Evaluating Step-by-step Reasoning Traces: A Survey
- More Thinking, Less Seeing? Assessing Amplified Hallucination in Multimodal Reasoning Models
- Monitoring Monitorability
- Visual-RFT: Visual Reinforcement Fine-Tuning
- DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
- SCI-Reason: A Dataset with Chain-of-Thought Rationales for Complex Multimodal Reasoning in Academic Areas
- Proximal Policy Optimization Algorithms
- DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models
- Attention-guided Fine-tuning of Multimodal Large Language Models Improves Chain-of-Thought Reasoning
- Gemma 3 Technical Report
- BigCharts-R1: Enhanced Chart Reasoning with Visual Reinforcement Finetuning
- InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency
- Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning
- LLaVA-CoT: Let Vision Language Models Reason Step-by-Step
- ChartBench: A Benchmark for Complex Visual Reasoning in Charts
- Chart-RVR: Reinforcement Learning with Verifiable Rewards for Explainable Chart Reasoning
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models