TY - RPRT TI - ProRL: Prolonged Reinforcement Learning Expands Reasoning Boundaries in Large Language Models AU - Mingjie Liu AU - Shizhe Diao AU - Ximing Lu AU - Jian Hu AU - Xin Dong AU - Yejin Choi AU - Jan Kautz AU - Yi Dong PY - 2025 UR - https://arxiv.org/abs/2505.24864 ID - 2505.24864 ER -