TY - RPRT TI - Deep Reinforcement Learning for Dynamic Algorithm Configuration: A Case Study on Optimizing OneMax with the (1+($λ$,$λ$))-GA AU - Tai Nguyen AU - Phong Le AU - André Biedenkapp AU - Carola Doerr AU - Nguyen Dang PY - 2026 DO - 10.1145/3821217 UR - https://arxiv.org/abs/2512.03805 ID - 2512.03805 ER -