TY - RPRT TI - Reinforcement Learning with Goal-Distance Gradient AU - Kai Jiang AU - XiaoLong Qin PY - 2020 UR - https://arxiv.org/abs/2001.00127 ID - 2001.00127 ER -