TY - RPRT TI - Memory Based Trajectory-conditioned Policies for Learning from Sparse Rewards AU - Yijie Guo AU - Jongwook Choi AU - Marcin Moczulski AU - Shengyu Feng AU - Samy Bengio AU - Mohammad Norouzi AU - Honglak Lee PY - 2021 UR - https://arxiv.org/abs/1907.10247 ID - 1907.10247 ER -