Geometric Encoding for Spatial Reasoning in Vision-Language Models

arXiv:2609.34148 · cs.CV · Submitted 2026-09-28 · Read on arXiv

cs.CV

Submitted: 2026-09-28

Updated: 2026-09-28

Code: https://github.com/QwenLM/Qwen3.5

Terminology

Sources

Related papers