TY - RPRT TI - Variational Information Maximisation for Intrinsically Motivated Reinforcement Learning AU - Shakir Mohamed AU - Danilo Jimenez Rezende PY - 2015 UR - https://arxiv.org/abs/1509.08731 ID - 1509.08731 ER -