TY - RPRT TI - Reinforcement Learning for Large Language Model Selective Evidence Adoption from Contaminated Retrieval Results AU - Yanyu Chen AU - Yue Li AU - Yongyi Cui AU - Dongsheng Shi AU - Lichang Dai PY - 2026 UR - https://arxiv.org/abs/2607.20090 ID - 2607.20090 ER -