TY - RPRT TI - Offline Reinforcement Learning as Anti-Exploration AU - Shideh Rezaeifar AU - Robert Dadashi AU - Nino Vieillard AU - Léonard Hussenot AU - Olivier Bachem AU - Olivier Pietquin AU - Matthieu Geist PY - 2021 UR - https://arxiv.org/abs/2106.06431 ID - 2106.06431 ER -