TY - RPRT TI - HAF-RM: A Hybrid Alignment Framework for Reward Model Training AU - Shujun Liu AU - Xiaoyu Shen AU - Yuhang Lai AU - Siyuan Wang AU - Shengbin Yue AU - Zengfeng Huang AU - Xuanjing Huang AU - Zhongyu Wei PY - 2025 UR - https://arxiv.org/abs/2407.04185 ID - 2407.04185 ER -