@misc{indiciae7847497bc577, title = {RetireOPD: Self-Retiring On-Policy Distillation for Agentic Reinforcement Learning}, author = {Yan Yu and Zhengxi Lu and Yizhou Liu and Yichen Pan and Aozhe Wang and Qipeng Chen and Hua Yang and Wenqi Zhang and Qianglong Chen and Yongliang Shen}, year = {2026}, url = {https://arxiv.org/abs/2609.20784}, note = {Source identifier: 2609.20784} }