TY - RPRT TI - Learning Sparse Rewarded Tasks from Sub-Optimal Demonstrations AU - Zhuangdi Zhu AU - Kaixiang Lin AU - Bo Dai AU - Jiayu Zhou PY - 2020 UR - https://arxiv.org/abs/2004.00530 ID - 2004.00530 ER -