CF-VLA: Efficient Coarse-to-Fine Action Generation for Vision-Language-Action Policies

arXiv:2604.24622 · cs.CV, cs.AI · Submitted 2026-04-27 · Read on arXiv

cs.CV, cs.AI

Submitted: 2026-04-27

Updated: 2026-09-04

Code: https://github.com/EmbodiedAI-RoboTron/CF-VLA

Terminology

Sources

Related papers