TY - RPRT TI - RRC: Unlocking Generative Reward Models in LLM Reinforcement Learning via Ranking-Based Reward Construction AU - Chenglong Wang AU - Ziming Zhu AU - Yifu Huo AU - Bei Li AU - Qiaozhi He AU - Yan Ding AU - Xiaoyang Hao AU - Yuxin Gao AU - Tianhua Zhou AU - Xiaojia Chang AU - Tongran Liu AU - Jingbo Zhu PY - 2026 UR - https://arxiv.org/abs/2608.06310 ID - 2608.06310 ER -