VIVAS: Vitalizing Visual Perception in VLM Pre-training via Vision-language Unified Autoregressive Supervision

arXiv:2609.27948 · cs.CV · Submitted 2026-08-25 · Read on arXiv

cs.CV

Submitted: 2026-08-25

Updated: 2026-08-25

Terminology

Sources

Related papers