TY - RPRT TI - SIGMA: Refining Large Language Model Reasoning via Sibling-Guided Monte Carlo Augmentation AU - Yanwei Ren AU - Haotian Zhang AU - Fuxiang Wu AU - Jiayan Qiu AU - Jiaxing Huang AU - Baosheng Yu AU - Liu Liu PY - 2025 UR - https://arxiv.org/abs/2506.06470 ID - 2506.06470 ER -