TY - RPRT TI - A Policy Search Method For Temporal Logic Specified Reinforcement Learning Tasks AU - Xiao Li AU - Yao Ma AU - Calin Belta PY - 2017 UR - https://arxiv.org/abs/1709.09611 ID - 1709.09611 ER -