TY - RPRT TI - Extrapolating Beyond Suboptimal Demonstrations via Inverse Reinforcement Learning from Observations AU - Daniel S. Brown AU - Wonjoon Goo AU - Prabhat Nagarajan AU - Scott Niekum PY - 2019 UR - https://arxiv.org/abs/1904.06387 ID - 1904.06387 ER -