PrefMoE: Robust Preference Modeling with Mixture-of-Experts Reward Learning

arXiv:2605.00384 · cs.RO · Submitted 2026-05-01 · Read on arXiv

cs.RO

Submitted: 2026-05-01

Updated: 2026-09-26

Project page: https://sites.google.com/view/moepref

Terminology

Related papers