TY - RPRT TI - Unicorn: Continual Learning with a Universal, Off-policy Agent AU - Daniel J. Mankowitz AU - Augustin Žídek AU - André Barreto AU - Dan Horgan AU - Matteo Hessel AU - John Quan AU - Junhyuk Oh AU - Hado van Hasselt AU - David Silver AU - Tom Schaul PY - 2018 UR - https://arxiv.org/abs/1802.08294 ID - 1802.08294 ER -