TY - RPRT TI - Rainbow: Combining Improvements in Deep Reinforcement Learning AU - Matteo Hessel AU - Joseph Modayil AU - Hado van Hasselt AU - Tom Schaul AU - Georg Ostrovski AU - Will Dabney AU - Dan Horgan AU - Bilal Piot AU - Mohammad Azar AU - David Silver PY - 2017 UR - https://arxiv.org/abs/1710.02298 ID - 1710.02298 ER -