TY - RPRT TI - Pretraining Deep Actor-Critic Reinforcement Learning Algorithms With Expert Demonstrations AU - Xiaoqin Zhang AU - Huimin Ma PY - 2018 UR - https://arxiv.org/abs/1801.10459 ID - 1801.10459 ER -