TY - RPRT TI - Offline Reinforcement Learning with Pseudometric Learning AU - Robert Dadashi AU - Shideh Rezaeifar AU - Nino Vieillard AU - Léonard Hussenot AU - Olivier Pietquin AU - Matthieu Geist PY - 2021 UR - https://arxiv.org/abs/2103.01948 ID - 2103.01948 ER -