TY - RPRT TI - UR$^2$: Unify RAG and Reasoning through Reinforcement Learning AU - Weitao Li AU - Boran Xiang AU - Xiaolong Wang AU - Jingyi Ren AU - Ante Wang AU - Zhinan Gou AU - Weizhi Ma AU - Yang Liu PY - 2026 UR - https://arxiv.org/abs/2508.06165 ID - 2508.06165 ER -