TY - RPRT TI - Averaged-DQN: Variance Reduction and Stabilization for Deep Reinforcement Learning AU - Oron Anschel AU - Nir Baram AU - Nahum Shimkin PY - 2017 UR - https://arxiv.org/abs/1611.01929 ID - 1611.01929 ER -