TY - RPRT TI - Diverse Policies Recovering via Pointwise Mutual Information Weighted Imitation Learning AU - Hanlin Yang AU - Jian Yao AU - Weiming Liu AU - Qing Wang AU - Hanmin Qin AU - Hansheng Kong AU - Kirk Tang AU - Jiechao Xiong AU - Chao Yu AU - Kai Li AU - Junliang Xing AU - Hongwu Chen AU - Juchao Zhuo AU - Qiang Fu AU - Yang Wei AU - Haobo Fu PY - 2024 UR - https://arxiv.org/abs/2410.15910 ID - 2410.15910 ER -