TY - RPRT TI - SWE-RL: Advancing LLM Reasoning via Reinforcement Learning on Open Software Evolution AU - Yuxiang Wei AU - Olivier Duchenne AU - Jade Copet AU - Quentin Carbonneaux AU - Lingming Zhang AU - Daniel Fried AU - Gabriel Synnaeve AU - Rishabh Singh AU - Sida I. Wang PY - 2025 UR - https://arxiv.org/abs/2502.18449 ID - 2502.18449 ER -