TY - RPRT TI - Deep Reinforcement Learning with Double Q-learning AU - Hado van Hasselt AU - Arthur Guez AU - David Silver PY - 2015 UR - https://arxiv.org/abs/1509.06461 ID - 1509.06461 ER -