@misc{indiciae83f5fafb3c30, title = {OffSeeker: Online Reinforcement Learning Is Not All You Need for Deep Research Agents}, author = {Yuhang Zhou and Kai Zheng and Qiguang Chen and Mengkang Hu and Qingfeng Sun and Can Xu and Jingjing Chen}, year = {2026}, url = {https://arxiv.org/abs/2601.18467}, note = {Source identifier: 2601.18467} }