AgentVidBench: A Multi-Hop Video Question Answering Benchmark for Evaluating MLLM Agents

arXiv:2609.21386 · cs.CV, cs.AI · Submitted 2026-09-18 · Read on arXiv

cs.CV, cs.AI

Submitted: 2026-09-18

Updated: 2026-09-18

Comments: 36 pages, 8 figures. Code: https://github.com/krafton-ai/agentvidbench Dataset: https://huggingface.co/datasets/agentvidbench/agentvidbench

Code: https://github.com/krafton-ai/agentvidbench

License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/

Terminology

Related papers