@misc{indiciae407ad781eb5b, title = {AdaptR1: Reinforcement Learning Based Adaptive Interleaved Thinking in Multi-hop Question Answering}, author = {Yuxin Wang and Jiahao Lu and Qifeng Wu and Shicheng Fang and Chuanyuan Tan and Yining Zheng and Xuanjing Huang and Xipeng Qiu}, year = {2026}, url = {https://arxiv.org/abs/2605.31062}, note = {Source identifier: 2605.31062} }