TY - RPRT TI - An Efficient and Precise Training Data Construction Framework for Process-supervised Reward Model in Mathematical Reasoning AU - Wei Sun AU - Qianlong Du AU - Fuwei Cui AU - Jiajun Zhang PY - 2025 UR - https://arxiv.org/abs/2503.02382 ID - 2503.02382 ER -