MoVISA: Multi-Token Reasoning for Video Object Segmentation

arXiv:2609.28956 · cs.CV · Submitted 2026-09-24 · Read on arXiv

cs.CV

Submitted: 2026-09-24

Updated: 2026-09-24

Code: https://github.com/InternLM/xtuner

Terminology

Sources

Related papers