TY - RPRT TI - Mutual Information Regularized Offline Reinforcement Learning AU - Xiao Ma AU - Bingyi Kang AU - Zhongwen Xu AU - Min Lin AU - Shuicheng Yan PY - 2024 UR - https://arxiv.org/abs/2210.07484 ID - 2210.07484 ER -