Harnessing Multimodal Large Language Models for Training-Free Human-Object Interaction Detection

arXiv:2610.06394 · cs.CV · Submitted 2026-10-05 · Read on arXiv

cs.CV

Submitted: 2026-10-05

Updated: 2026-10-05

Related papers