TY - RPRT TI - From Refuse to Richness: Rubric Rewards for Long-Form Hallucination Reinforcement Learning AU - Yudong Wang AU - Zhe Yang AU - Wenhan Ma AU - Rang Li AU - Qibin Yang AU - Weimin Xiong AU - Jiangshan Duo AU - Liang Zhao AU - Zhifang Sui PY - 2026 UR - https://arxiv.org/abs/2608.12337 ID - 2608.12337 ER -