TY - RPRT TI - AdaptR1: Reinforcement Learning Based Adaptive Interleaved Thinking in Multi-hop Question Answering AU - Yuxin Wang AU - Jiahao Lu AU - Qifeng Wu AU - Shicheng Fang AU - Chuanyuan Tan AU - Yining Zheng AU - Xuanjing Huang AU - Xipeng Qiu PY - 2026 UR - https://arxiv.org/abs/2605.31062 ID - 2605.31062 ER -