@misc{indiciaeb439ab828143, title = {ProRL: Prolonged Reinforcement Learning Expands Reasoning Boundaries in Large Language Models}, author = {Mingjie Liu and Shizhe Diao and Ximing Lu and Jian Hu and Xin Dong and Yejin Choi and Jan Kautz and Yi Dong}, year = {2025}, url = {https://arxiv.org/abs/2505.24864}, note = {Source identifier: 2505.24864} }