TY - RPRT TI - Learning from Mistakes: Negative Reasoning Samples Enhance Out-of-Domain Generalization AU - Xueyun Tian AU - Minghua Ma AU - Bingbing Xu AU - Nuoyan Lyu AU - Wei Li AU - Heng Dong AU - Zheng Chu AU - Yuanzhuo Wang AU - Huawei Shen PY - 2026 UR - https://arxiv.org/abs/2601.04992 ID - 2601.04992 ER -