TY - RPRT TI - Online reinforcement learning with sparse rewards through an active inference capsule AU - Alejandro Daniel Noel AU - Charel van Hoof AU - Beren Millidge PY - 2021 UR - https://arxiv.org/abs/2106.02390 ID - 2106.02390 ER -