TY - RPRT TI - Write, Execute, Refine: From Skill Followers to Skill Optimizers via Reinforcement Learning from Execution Feedback AU - Kang Peng AU - Zhiwei Zhang AU - Yichen Zhang AU - Zezhong Wang AU - Yiming Du AU - Geng Tu AU - Baojun Wang AU - Bin Liang AU - Ruifeng Xu AU - Kam-Fai Wong PY - 2026 UR - https://arxiv.org/abs/2608.17587 ID - 2608.17587 ER -