TY - RPRT TI - Robust Offline Reinforcement learning with Heavy-Tailed Rewards AU - Jin Zhu AU - Runzhe Wan AU - Zhengling Qi AU - Shikai Luo AU - Chengchun Shi PY - 2024 UR - https://arxiv.org/abs/2310.18715 ID - 2310.18715 ER -