TY - RPRT TI - CuDIP: Enhancing Theorem Proving in LLMs via Curriculum Learning-based Direct Preference Optimization AU - Shuming Shi AU - Ruobing Zuo AU - Gaolei He AU - Jianlin Wang AU - Chenyang Xu AU - Zhengfeng Yang PY - 2025 UR - https://arxiv.org/abs/2502.18532 ID - 2502.18532 ER -