TY - RPRT TI - Scalable trust-region method for deep reinforcement learning using Kronecker-factored approximation AU - Yuhuai Wu AU - Elman Mansimov AU - Shun Liao AU - Roger Grosse AU - Jimmy Ba PY - 2017 UR - https://arxiv.org/abs/1708.05144 ID - 1708.05144 ER -