@misc{indiciae7171c570eb56, title = {AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning}, author = {Zi-Han Wang and Zhengxi Lu and Zhiyuan Yao and Jinyang Wu and Jie Wu and Zhengzhou Cai and Yueqing Sun and Ziang Ye and Linji Hao and Qi Gu and Xunliang Cai and Yongliang Shen and Yujiu Yang}, year = {2026}, url = {https://arxiv.org/abs/2608.05987}, note = {Source identifier: 2608.05987} }