TY - RPRT TI - Optimal Reinforcement Learning for Gaussian Systems AU - Philipp Hennig PY - 2011 UR - https://arxiv.org/abs/1106.0800 ID - 1106.0800 ER -