TY - RPRT TI - Offline Reinforcement Learning Hands-On AU - Louis Monier AU - Jakub Kmec AU - Alexandre Laterre AU - Thomas Pierrot AU - Valentin Courgeau AU - Olivier Sigaud AU - Karim Beguir PY - 2020 UR - https://arxiv.org/abs/2011.14379 ID - 2011.14379 ER -