TY - RPRT TI - Bias-reduced Multi-step Hindsight Experience Replay for Efficient Multi-goal Reinforcement Learning AU - Rui Yang AU - Jiafei Lyu AU - Yu Yang AU - Jiangpeng Yan AU - Feng Luo AU - Dijun Luo AU - Lanqing Li AU - Xiu Li PY - 2022 UR - https://arxiv.org/abs/2102.12962 ID - 2102.12962 ER -