TY - RPRT TI - An Information-Theoretic Optimality Principle for Deep Reinforcement Learning AU - Felix Leibfried AU - Jordi Grau-Moya AU - Haitham Bou-Ammar PY - 2018 UR - https://arxiv.org/abs/1708.01867 ID - 1708.01867 ER -