@misc{indiciae8f897bfd949d, title = {HAF-RM: A Hybrid Alignment Framework for Reward Model Training}, author = {Shujun Liu and Xiaoyu Shen and Yuhang Lai and Siyuan Wang and Shengbin Yue and Zengfeng Huang and Xuanjing Huang and Zhongyu Wei}, year = {2025}, url = {https://arxiv.org/abs/2407.04185}, note = {Source identifier: 2407.04185} }