TY - RPRT TI - LongPO: Long Context Self-Evolution of Large Language Models through Short-to-Long Preference Optimization AU - Guanzheng Chen AU - Xin Li AU - Michael Qizhe Shieh AU - Lidong Bing PY - 2025 UR - https://arxiv.org/abs/2502.13922 ID - 2502.13922 ER -