TY - RPRT TI - Towards Safe Reinforcement Learning Using NMPC and Policy Gradients: Part I - Stochastic case AU - Sebastien Gros AU - Mario Zanon PY - 2019 UR - https://arxiv.org/abs/1906.04057 ID - 1906.04057 ER -