TY - RPRT TI - Safe Imitation Learning via Fast Bayesian Reward Inference from Preferences AU - Daniel S. Brown AU - Russell Coleman AU - Ravi Srinivasan AU - Scott Niekum PY - 2020 UR - https://arxiv.org/abs/2002.09089 ID - 2002.09089 ER -