TY - RPRT TI - Thinking Forward and Backward: Multi-Objective Reinforcement Learning for Retrieval-Augmented Reasoning AU - Wenda Wei AU - Yu-An Liu AU - Ruqing Zhang AU - Jiafeng Guo AU - Lixin Su AU - Shuaiqiang Wang AU - Dawei Yin AU - Maarten de Rijke AU - Xueqi Cheng PY - 2025 UR - https://arxiv.org/abs/2511.09109 ID - 2511.09109 ER -