TY - RPRT TI - RL$^2$: Fast Reinforcement Learning via Slow Reinforcement Learning AU - Yan Duan AU - John Schulman AU - Xi Chen AU - Peter L. Bartlett AU - Ilya Sutskever AU - Pieter Abbeel PY - 2016 UR - https://arxiv.org/abs/1611.02779 ID - 1611.02779 ER -