TY - RPRT TI - Task-Agnostic Online Reinforcement Learning with an Infinite Mixture of Gaussian Processes AU - Mengdi Xu AU - Wenhao Ding AU - Jiacheng Zhu AU - Zuxin Liu AU - Baiming Chen AU - Ding Zhao PY - 2020 UR - https://arxiv.org/abs/2006.11441 ID - 2006.11441 ER -