TY - RPRT TI - Learning to Extract Rational Evidence via Reinforcement Learning for Retrieval-Augmented Generation AU - Xinping Zhao AU - Shouzheng Huang AU - Yan Zhong AU - Xinshuo Hu AU - Meishan Zhang AU - Baotian Hu AU - Min Zhang PY - 2026 UR - https://arxiv.org/abs/2507.15586 ID - 2507.15586 ER -