Beyond Pairwise Feedback: Listwise Vision-Language Supervision for Preference-Based Reward Learning

arXiv:2608.25350 · cs.LG, cs.RO · Submitted 2026-08-26 · Read on arXiv

cs.LG, cs.RO

Submitted: 2026-08-26

Updated: 2026-08-26

Comments: 13 pages, 10 figures. Srivalli Katkuri and Maxwell Kawada contributed equally to this work

License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/

Terminology

Sources

Related papers