Bridging the 2D-3D Gap: A Hierarchical Semantic-Geometric Map for Vision Language Navigation

arXiv:2606.00095 · cs.CV, cs.AI, cs.CL, cs.RO · Submitted 2026-05-25 · Read on arXiv

cs.CV, cs.AI, cs.CL, cs.RO

Submitted: 2026-05-25

Updated: 2026-05-25

Journal ref: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2026, pp. 15243-15252

Code: https://github.com/Teacher-Tom/HSGM_public

License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/

Terminology

Sources

Related papers