TY - RPRT TI - MTRec: Learning to Align with User Preferences via Mental Reward Models AU - Mengchen Zhao AU - Yifan Gao AU - Yaqing Hou AU - Xiangyang Li AU - Pengjie Gu AU - Zhenhua Dong AU - Ruiming Tang AU - Yi Cai PY - 2025 UR - https://arxiv.org/abs/2509.22807 ID - 2509.22807 ER -