TY - RPRT TI - Towards Safe Reinforcement Learning Using NMPC and Policy Gradients: Part II - Deterministic Case AU - Sebastien Gros AU - Mario Zanon PY - 2019 UR - https://arxiv.org/abs/1906.04034 ID - 1906.04034 ER -