TY - RPRT TI - Group-Reflective Self-Distillation for Agentic Reinforcement Learning AU - Binbin Zheng AU - Zijun Xie AU - Guanqun Zhao AU - Enlei Gong AU - Xing Ma AU - Xiaoliang Fu AU - Zeyu Chen PY - 2026 UR - https://arxiv.org/abs/2607.28076 ID - 2607.28076 ER -