TY - RPRT TI - SCAN: Self-Denoising Monte Carlo Annotation for Robust Process Reward Learning AU - Yuyang Ding AU - Xinyu Shi AU - Juntao Li AU - Xiaobo Liang AU - Zhaopeng Tu AU - Min Zhang PY - 2025 UR - https://arxiv.org/abs/2509.16548 ID - 2509.16548 ER -