TY - RPRT TI - Can Large Language Models Detect Errors in Long Chain-of-Thought Reasoning? AU - Yancheng He AU - Shilong Li AU - Jiaheng Liu AU - Weixun Wang AU - Xingyuan Bu AU - Ge Zhang AU - Zhongyuan Peng AU - Zhaoxiang Zhang AU - Zhicheng Zheng AU - Wenbo Su AU - Bo Zheng PY - 2025 UR - https://arxiv.org/abs/2502.19361 ID - 2502.19361 ER -