TY - RPRT TI - Evolution Strategies at Scale: LLM Fine-Tuning Beyond Reinforcement Learning AU - Xin Qiu AU - Yulu Gan AU - Conor F. Hayes AU - Qiyao Liang AU - Yinggan Xu AU - Roberto Dailey AU - Elliot Meyerson AU - Babak Hodjat AU - Risto Miikkulainen PY - 2026 UR - https://arxiv.org/abs/2509.24372 ID - 2509.24372 ER -