TY - RPRT TI - Model-Based Reinforcement Learning via Meta-Policy Optimization AU - Ignasi Clavera AU - Jonas Rothfuss AU - John Schulman AU - Yasuhiro Fujita AU - Tamim Asfour AU - Pieter Abbeel PY - 2018 UR - https://arxiv.org/abs/1809.05214 ID - 1809.05214 ER -