TY - RPRT TI - Reinforcement Learning Based Temporal Logic Control with Maximum Probabilistic Satisfaction AU - Mingyu Cai AU - Shaoping Xiao AU - Baoluo Li AU - Zhiliang Li AU - Zhen Kan PY - 2021 DO - 10.1109/icra48506.2021.9561903 UR - https://arxiv.org/abs/2010.06797 ID - 2010.06797 ER -