Direction-Scale Decomposition in Action Representation: Rethinking What to Tokenize for Vision-Language-Action Models

arXiv:2609.28865 · cs.CV, cs.RO · Submitted 2026-09-24 · Read on arXiv

cs.CV, cs.RO

Submitted: 2026-09-24

Updated: 2026-09-24

Project page: https://vla-dsd.github.io

Terminology

Sources

Related papers