TY - RPRT TI - GRAM: A Generative Foundation Reward Model for Reward Generalization AU - Chenglong Wang AU - Yang Gan AU - Yifu Huo AU - Yongyu Mu AU - Qiaozhi He AU - Murun Yang AU - Bei Li AU - Tong Xiao AU - Chunliang Zhang AU - Tongran Liu AU - Jingbo Zhu PY - 2026 UR - https://arxiv.org/abs/2506.14175 ID - 2506.14175 ER -