TY - RPRT TI - Learning and Policy Search in Stochastic Dynamical Systems with Bayesian Neural Networks AU - Stefan Depeweg AU - José Miguel Hernández-Lobato AU - Finale Doshi-Velez AU - Steffen Udluft PY - 2017 UR - https://arxiv.org/abs/1605.07127 ID - 1605.07127 ER -