INTCORT: Training-Free Spatial Reasoning Enhancement for Vision-Language Models via Input Transformations and Confidence Routing

arXiv:2609.24813 · cs.CV · Submitted 2026-09-21 · Read on arXiv

cs.CV

Submitted: 2026-09-21

Updated: 2026-09-21

Terminology

Sources

Related papers