TY - RPRT TI - Multi-task Deep Reinforcement Learning with PopArt AU - Matteo Hessel AU - Hubert Soyer AU - Lasse Espeholt AU - Wojciech Czarnecki AU - Simon Schmitt AU - Hado van Hasselt PY - 2018 UR - https://arxiv.org/abs/1809.04474 ID - 1809.04474 ER -