@misc{indiciaee70aee9949d9, title = {Teaching LLMs for Step-Level Automatic Math Correction via Reinforcement Learning}, author = {Junsong Li and Jie Zhou and Yutao Yang and Bihao Zhan and Qianjun Pan and Yuyang Ding and Qin Chen and Jiang Bo and Xin Lin and Liang He}, year = {2025}, url = {https://arxiv.org/abs/2503.18432}, note = {Source identifier: 2503.18432} }