TY - RPRT TI - Long-Term Visitation Value for Deep Exploration in Sparse Reward Reinforcement Learning AU - Simone Parisi AU - Davide Tateo AU - Maximilian Hensel AU - Carlo D'Eramo AU - Jan Peters AU - Joni Pajarinen PY - 2022 DO - 10.3390/a15030081 UR - https://arxiv.org/abs/2001.00119 ID - 2001.00119 ER -