TY - RPRT TI - Efficiently Training On-Policy Actor-Critic Networks in Robotic Deep Reinforcement Learning with Demonstration-like Sampled Exploration AU - Zhaorun Chen AU - Binhao Chen AU - Shenghan Xie AU - Liang Gong AU - Chengliang Liu AU - Zhengfeng Zhang AU - Junping Zhang PY - 2021 UR - https://arxiv.org/abs/2109.13005 ID - 2109.13005 ER -