TY - RPRT TI - R3-RAG: Learning Step-by-Step Reasoning and Retrieval for LLMs via Reinforcement Learning AU - Yuan Li AU - Qi Luo AU - Xiaonan Li AU - Bufan Li AU - Qinyuan Cheng AU - Bo Wang AU - Yining Zheng AU - Yuxin Wang AU - Zhangyue Yin AU - Xipeng Qiu PY - 2025 UR - https://arxiv.org/abs/2505.23794 ID - 2505.23794 ER -