TY - RPRT TI - Inverse Reinforcement Learning with Explicit Policy Estimates AU - Navyata Sanghvi AU - Shinnosuke Usami AU - Mohit Sharma AU - Joachim Groeger AU - Kris Kitani PY - 2021 UR - https://arxiv.org/abs/2103.02863 ID - 2103.02863 ER -