TY - RPRT TI - Efficient Sparse-Reward Goal-Conditioned Reinforcement Learning with a High Replay Ratio and Regularization AU - Takuya Hiraoka PY - 2023 UR - https://arxiv.org/abs/2312.05787 ID - 2312.05787 ER -