TY - RPRT TI - PERM: Psychology-grounded Empathetic Reward Modeling for Large Language Models AU - Chengbing Wang AU - Wuqiang Zheng AU - Yang Zhang AU - Fengbin Zhu AU - Junyi Cheng AU - Yi Xie AU - Wenjie Wang AU - Fuli Feng PY - 2026 UR - https://arxiv.org/abs/2601.10532 ID - 2601.10532 ER -