TY - RPRT TI - Sample Efficient Reinforcement Learning via Model-Ensemble Exploration and Exploitation AU - Yao Yao AU - Li Xiao AU - Zhicheng An AU - Wanpeng Zhang AU - Dijun Luo PY - 2021 UR - https://arxiv.org/abs/2107.01825 ID - 2107.01825 ER -