TY - RPRT TI - Genetic multi-armed bandits: a reinforcement learning approach for discrete optimization via simulation AU - Deniz Preil AU - Michael Krapp PY - 2023 UR - https://arxiv.org/abs/2302.07695 ID - 2302.07695 ER -