TY - RPRT TI - On-Policy Robot Imitation Learning from a Converging Supervisor AU - Ashwin Balakrishna AU - Brijen Thananjeyan AU - Jonathan Lee AU - Felix Li AU - Arsh Zahed AU - Joseph E. Gonzalez AU - Ken Goldberg PY - 2020 UR - https://arxiv.org/abs/1907.03423 ID - 1907.03423 ER -