TY - RPRT TI - Reset-Free Guided Policy Search: Efficient Deep Reinforcement Learning with Stochastic Initial States AU - William Montgomery AU - Anurag Ajay AU - Chelsea Finn AU - Pieter Abbeel AU - Sergey Levine PY - 2016 UR - https://arxiv.org/abs/1610.01112 ID - 1610.01112 ER -