UVLM: A Universal Vision-Language Model Loader for Reproducible Multimodal Benchmarking

arXiv:2603.13893 · cs.LG, cs.AI, cs.CV · Submitted 2026-03-14 · Read on arXiv

Joan Perez, Giovanni Fusco

cs.LG, cs.AI, cs.CV

Submitted: 2026-03-14

Updated: 2026-08-21

Code: https://github.com/perezjoan/UVLM

Terminology

Sources

Related papers