DARE to Mitigate Hallucination: Dual-path Auto-Regressive-aware Editing
cs.CV
Submitted: 2026-09-29
Updated: 2026-09-29
Code: https://github.com/KU-VGI/DARE
Terminology
Sources
- Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond
- Qwen3-VL Technical Report
- Shikra: Unleashing Multimodal LLM's Referential Dialogue Magic
- HALC: Object Hallucination Reduction via Adaptive Focal-Contrast Decoding
- Beam Search Strategies for Neural Machine Translation
- MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models
- Contrastive Decoding: Open-ended Text Generation as Optimization
- Mitigating Hallucination in Large Multi-Modal Models via Robust Instruction Tuning
- Improved Baselines with Visual Instruction Tuning
- Investigating and Mitigating Object Hallucinations in Pretrained Vision-Language (CLIP) Models
- Instruction Tuning with GPT-4
- A Survey of Hallucination in Large Foundation Models
- Object Hallucination in Image Captioning
- Gemma 3 Technical Report
- Beyond Hallucinations: Enhancing LVLMs through Hallucination-Aware Direct Preference Optimization
- Analyzing and Mitigating Object Hallucination in Large Vision-Language Models
- MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models