Grounding Vision-Language Models in Driving Semantics: A Multi-Dataset Predicate Framework for Explainable Reasoning

arXiv:2609.31636 · cs.LG, cs.CV, cs.RO · Submitted 2026-09-10 · Read on arXiv

cs.LG, cs.CV, cs.RO

Submitted: 2026-09-10

Updated: 2026-09-10

Code: https://github.com/AImotion-Bavaria/nuPlan_

Terminology

Related papers