TY - RPRT TI - Towards Applicable Reinforcement Learning: Improving the Generalization and Sample Efficiency with Policy Ensemble AU - Zhengyu Yang AU - Kan Ren AU - Xufang Luo AU - Minghuan Liu AU - Weiqing Liu AU - Jiang Bian AU - Weinan Zhang AU - Dongsheng Li PY - 2022 UR - https://arxiv.org/abs/2205.09284 ID - 2205.09284 ER -