TY - RPRT TI - Proximal Policy Optimization with Mixed Distributed Training AU - Zhenyu Zhang AU - Xiangfeng Luo AU - Tong Liu AU - Shaorong Xie AU - Jianshu Wang AU - Wei Wang AU - Yang Li AU - Yan Peng PY - 2019 UR - https://arxiv.org/abs/1907.06479 ID - 1907.06479 ER -