TY - RPRT TI - Afterburner: Reinforcement Learning Facilitates Self-Improving Code Efficiency Optimization AU - Mingzhe Du AU - Luu Anh Tuan AU - Yue Liu AU - Yuhao Qing AU - Dong Huang AU - Xinyi He AU - Qian Liu AU - Zejun Ma AU - See-kiong Ng PY - 2025 UR - https://arxiv.org/abs/2505.23387 ID - 2505.23387 ER -