TY - RPRT TI - IOPO: Empowering LLMs with Complex Instruction Following via Input-Output Preference Optimization AU - Xinghua Zhang AU - Haiyang Yu AU - Cheng Fu AU - Fei Huang AU - Yongbin Li PY - 2025 UR - https://arxiv.org/abs/2411.06208 ID - 2411.06208 ER -