TY - RPRT TI - Temporal-Logic-Based Reward Shaping for Continuing Reinforcement Learning Tasks AU - Yuqian Jiang AU - Sudarshanan Bharadwaj AU - Bo Wu AU - Rishi Shah AU - Ufuk Topcu AU - Peter Stone PY - 2023 DO - 10.1609/aaai.v35i9.16975 UR - https://arxiv.org/abs/2007.01498 ID - 2007.01498 ER -