TY - RPRT TI - Learning Deep Stochastic Optimal Control Policies using Forward-Backward SDEs AU - Marcus Pereira AU - Ziyi Wang AU - Ioannis Exarchos AU - Evangelos A. Theodorou PY - 2021 DO - 10.15607/rss.2019.xv.070 UR - https://arxiv.org/abs/1902.03986 ID - 1902.03986 ER -