TY - RPRT TI - Efficient Exploration of Reward Functions in Inverse Reinforcement Learning via Bayesian Optimization AU - Sreejith Balakrishnan AU - Quoc Phong Nguyen AU - Bryan Kian Hsiang Low AU - Harold Soh PY - 2020 UR - https://arxiv.org/abs/2011.08541 ID - 2011.08541 ER -