TY - RPRT TI - Efficient Deep Reinforcement Learning via Adaptive Policy Transfer AU - Tianpei Yang AU - Jianye Hao AU - Zhaopeng Meng AU - Zongzhang Zhang AU - Yujing Hu AU - Yingfeng Cheng AU - Changjie Fan AU - Weixun Wang AU - Wulong Liu AU - Zhaodong Wang AU - Jiajie Peng PY - 2020 UR - https://arxiv.org/abs/2002.08037 ID - 2002.08037 ER -