@misc{indiciae032785ea6e90, title = {Save the Good Prefix: Precise Error Penalization via Process-Supervised RL to Enhance LLM Reasoning}, author = {Haolin Liu and Dian Yu and Sidi Lu and Yujun Zhou and Rui Liu and Zhenwen Liang and Haitao Mi and Chen-Yu Wei and Dong Yu}, year = {2026}, url = {https://arxiv.org/abs/2601.18984}, note = {Source identifier: 2601.18984} }