TY - RPRT TI - Learning from Imperfect Demonstrations from Agents with Varying Dynamics AU - Zhangjie Cao AU - Dorsa Sadigh PY - 2021 UR - https://arxiv.org/abs/2103.05910 ID - 2103.05910 ER -