TY - RPRT TI - Maximum Entropy Gain Exploration for Long Horizon Multi-goal Reinforcement Learning AU - Silviu Pitis AU - Harris Chan AU - Stephen Zhao AU - Bradly Stadie AU - Jimmy Ba PY - 2020 UR - https://arxiv.org/abs/2007.02832 ID - 2007.02832 ER -