CausalDriveBench: Evaluating Causal Reasoning in Vision-Language-Action Models for Autonomous Driving
cs.CV, cs.RO
Submitted: 2026-09-26
Updated: 2026-09-26
Terminology
Sources
- Cosmos-Reason1: From Physical Common Sense To Embodied Reasoning
- Qwen3-VL Technical Report
- Impromptu VLA: Open Weights and Open Data for Driving Vision-Language-Action Models
- DriveAction: A Benchmark for Exploring Human-like Driving Decisions in VLA Models
- EMMA: End-to-End Multimodal Model for Autonomous Driving
- A Survey on Vision-Language-Action Models for Autonomous Driving
- ReCogDrive: A Reinforced Cognitive Framework for End-to-End Autonomous Driving
- UniDriveVLA: Unifying Understanding, Perception, and Action Planning for Autonomous Driving
- Counterfactual VLA: Self-Reflective Vision-Language-Action Model with Adaptive Reasoning
- Alpamayo-R1: Bridging Reasoning and Action Prediction for Generalizable Autonomous Driving in the Long Tail
- Argoverse 2: Next Generation Datasets for Self-Driving Perception and Forecasting
- DriveMoE: Mixture-of-Experts for Vision-Language-Action Model in End-to-End Autonomous Driving
- CoC-VLA: Delving into Adversarial Domain Transfer for Explainable Autonomous Driving via Chain-of-Causality Visual-Language-Action Model
- SafeAuto: Knowledge-Enhanced Safe Autonomous Driving with Multimodal Foundation Models
- WiseAD: Knowledge Augmented End-to-End Autonomous Driving with Vision-Language Model
- OpenREAD: Reinforced Open-Ended Reasoning for End-to-End Autonomous Driving with LLM-as-Critic
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models