TY - RPRT TI - ReasonGRM: Enhancing Generative Reward Models through Large Reasoning Models AU - Bin Chen AU - Xinzge Gao AU - Chuanrui Hu AU - Penghang Yu AU - Hua Zhang AU - Bing-Kun Bao PY - 2025 UR - https://arxiv.org/abs/2506.16712 ID - 2506.16712 ER -