MM-VeriAgent: Learning to Use Extensive Tools to Verify Multimodal Misinformation with Reinforcement Learning
cs.CV
Submitted: 2026-09-25
Updated: 2026-09-25
Terminology
Sources
- Qwen2.5-VL Technical Report
- Qwen3-VL Technical Report
- Can LLMs Improve Multimodal Fact-Checking by Asking Relevant Questions?
- Dual Data Alignment Makes AI-Generated Image Detector Easier Generalizable
- Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities
- Tool-Star: Empowering LLM-Brained Multi-Tool Reasoner via Reinforcement Learning
- ReTool: Reinforcement Learning for Strategic Tool Use in LLMs
- Veri-R1: Toward Precise and Faithful Claim Verification via Online Reinforcement Learning
- CacheRL:Multi-Turn Tool-Calling Agents via Cached Rollouts and Hybrid Reward
- VerlTool: Towards Holistic Agentic Reinforcement Learning with Tool Use
- Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning
- Large Language Model Agent for Fake News Detection
- Simulating Environments with Reasoning Models for Agent Training
- GPT-4o System Card
- DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models
- TVCACHE: A Stateful Tool-Value Cache for Post-Training LLM Agents
- Qwen3 Technical Report
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models