TY - RPRT TI - Residual Reward Models: Leveraging Prior Knowledge for Efficient Preference-based Reinforcement Learning in Robotics AU - Chenyang Cao AU - Miguel Rogel-GarcĂ­a AU - Mohamed Nabail AU - Xueqian Wang AU - Nicholas Rhinehart PY - 2026 UR - https://arxiv.org/abs/2507.00611 ID - 2507.00611 ER -