TY - RPRT TI - OffSeeker: Online Reinforcement Learning Is Not All You Need for Deep Research Agents AU - Yuhang Zhou AU - Kai Zheng AU - Qiguang Chen AU - Mengkang Hu AU - Qingfeng Sun AU - Can Xu AU - Jingjing Chen PY - 2026 UR - https://arxiv.org/abs/2601.18467 ID - 2601.18467 ER -