TY - RPRT TI - AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning AU - Zi-Han Wang AU - Zhengxi Lu AU - Zhiyuan Yao AU - Jinyang Wu AU - Jie Wu AU - Zhengzhou Cai AU - Yueqing Sun AU - Ziang Ye AU - Linji Hao AU - Qi Gu AU - Xunliang Cai AU - Yongliang Shen AU - Yujiu Yang PY - 2026 UR - https://arxiv.org/abs/2608.05987 ID - 2608.05987 ER -