TY - RPRT TI - Relay Hindsight Experience Replay: Self-Guided Continual Reinforcement Learning for Sequential Object Manipulation Tasks with Sparse Rewards AU - Yongle Luo AU - Yuxin Wang AU - Kun Dong AU - Qiang Zhang AU - Erkang Cheng AU - Zhiyong Sun AU - Bo Song PY - 2022 UR - https://arxiv.org/abs/2208.00843 ID - 2208.00843 ER -