TY - RPRT TI - Beyond Reward Hacking: Causal Rewards for Large Language Model Alignment AU - Chaoqi Wang AU - Zhuokai Zhao AU - Yibo Jiang AU - Zhaorun Chen AU - Chen Zhu AU - Yuxin Chen AU - Jiayi Liu AU - Lizhu Zhang AU - Xiangjun Fan AU - Hao Ma AU - Sinong Wang PY - 2025 UR - https://arxiv.org/abs/2501.09620 ID - 2501.09620 ER -