TY - RPRT TI - Sequence-level Large Language Model Training with Contrastive Preference Optimization AU - Zhili Feng AU - Dhananjay Ram AU - Cole Hawkins AU - Aditya Rawal AU - Jinman Zhao AU - Sheng Zha PY - 2025 UR - https://arxiv.org/abs/2502.16433 ID - 2502.16433 ER -