TY - RPRT TI - Mutual Information-based State-Control for Intrinsically Motivated Reinforcement Learning AU - Rui Zhao AU - Yang Gao AU - Pieter Abbeel AU - Volker Tresp AU - Wei Xu PY - 2020 UR - https://arxiv.org/abs/2002.01963 ID - 2002.01963 ER -