TY - RPRT TI - When does return-conditioned supervised learning work for offline reinforcement learning? AU - David Brandfonbrener AU - Alberto Bietti AU - Jacob Buckman AU - Romain Laroche AU - Joan Bruna PY - 2023 UR - https://arxiv.org/abs/2206.01079 ID - 2206.01079 ER -