TY - RPRT TI - Model-Free Reinforcement Learning for Optimal Control of MarkovDecision Processes Under Signal Temporal Logic Specifications AU - Krishna C. Kalagarla AU - Rahul Jain AU - Pierluigi Nuzzo PY - 2021 UR - https://arxiv.org/abs/2109.13377 ID - 2109.13377 ER -