TY - RPRT TI - Model-Free Imitation Learning with Policy Optimization AU - Jonathan Ho AU - Jayesh K. Gupta AU - Stefano Ermon PY - 2016 UR - https://arxiv.org/abs/1605.08478 ID - 1605.08478 ER -