TY - RPRT TI - Policy Gradient Bayesian Robust Optimization for Imitation Learning AU - Zaynah Javed AU - Daniel S. Brown AU - Satvik Sharma AU - Jerry Zhu AU - Ashwin Balakrishna AU - Marek Petrik AU - Anca D. Dragan AU - Ken Goldberg PY - 2021 UR - https://arxiv.org/abs/2106.06499 ID - 2106.06499 ER -