StrataVLA: Hierarchical and Efficient 3D Geometric Grounding for Vision-Language-Action Models

arXiv:2609.26071 · cs.RO · Submitted 2026-08-03 · Read on arXiv

cs.RO

Submitted: 2026-08-03

Updated: 2026-08-03

Terminology

Sources

Related papers