TY - RPRT TI - Reinforcement Learning through Asynchronous Advantage Actor-Critic on a GPU AU - Mohammad Babaeizadeh AU - Iuri Frosio AU - Stephen Tyree AU - Jason Clemons AU - Jan Kautz PY - 2017 UR - https://arxiv.org/abs/1611.06256 ID - 1611.06256 ER -