Anchoring What Matters: A Dual-Level Learning Framework for Visually-Grounded Multimodal Reasoning

arXiv:2609.18057 · cs.AI · Submitted 2026-09-16 · Read on arXiv

cs.AI

Submitted: 2026-09-16

Updated: 2026-09-16

License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/

Terminology

Sources

Related papers