@misc{indiciaeb8415b79ebda, title = {S-GRPO: Early Exit via Reinforcement Learning in Reasoning Models}, author = {Muzhi Dai and Chenxu Yang and Qingyi Si}, year = {2025}, url = {https://arxiv.org/abs/2505.07686}, note = {Source identifier: 2505.07686} }