@misc{indiciae0c016bb8f9d5, title = {Is One Layer Enough? Training A Single Transformer Layer Can Match Full-Parameter RL Training}, author = {Zijian Zhang and Rizhen Hu and Athanasios Glentis and Dawei Li and Chung-Yiu Yau and Hongzhou Lin and Mingyi Hong}, year = {2026}, url = {https://arxiv.org/abs/2607.01232}, note = {Source identifier: 2607.01232} }