TY - RPRT TI - Robot Policy Learning with Temporal Optimal Transport Reward AU - Yuwei Fu AU - Haichao Zhang AU - Di Wu AU - Wei Xu AU - Benoit Boulet PY - 2024 UR - https://arxiv.org/abs/2410.21795 ID - 2410.21795 ER -