TY - RPRT TI - To the Max: Reinventing Reward in Reinforcement Learning AU - Grigorii Veviurko AU - Wendelin Böhmer AU - Mathijs de Weerdt PY - 2024 UR - https://arxiv.org/abs/2402.01361 ID - 2402.01361 ER -