TY - RPRT TI - Reward prediction for representation learning and reward shaping AU - Hlynur Davíð Hlynsson AU - Laurenz Wiskott PY - 2021 UR - https://arxiv.org/abs/2105.03172 ID - 2105.03172 ER -