TY - RPRT TI - Preference-Calibrated Human-in-the-Loop Reinforcement Learning for Robotic Manipulation AU - Zeyi Liu AU - Guangyao Liu AU - Yinuo Qu AU - Yuquan Xue AU - Bofang Jia AU - Chunhua Yang AU - Weihua Gui AU - Keke Huang AU - Ziwei Wang PY - 2026 UR - https://arxiv.org/abs/2606.03949 ID - 2606.03949 ER -