TY - RPRT TI - Learning to Self-Verify Makes Language Models Better Reasoners AU - Yuxin Chen AU - Yu Wang AU - Yi Zhang AU - Ziang Ye AU - Zhengzhou Cai AU - Yaorui Shi AU - Qi Gu AU - Hui Su AU - Xunliang Cai AU - Xiang Wang AU - An Zhang AU - Tat-Seng Chua PY - 2026 UR - https://arxiv.org/abs/2602.07594 ID - 2602.07594 ER -