TY - RPRT TI - Exploiting Transformer in Sparse Reward Reinforcement Learning for Interpretable Temporal Logic Motion Planning AU - Hao Zhang AU - Hao Wang AU - Zhen Kan PY - 2023 DO - 10.1109/lra.2023.3290511 UR - https://arxiv.org/abs/2209.13220 ID - 2209.13220 ER -