TY - RPRT TI - Model Based Reinforcement Learning with Final Time Horizon Optimization AU - Wei Sun AU - Evangelos Theodorou AU - Panagiotis Tsiotras PY - 2015 UR - https://arxiv.org/abs/1509.01186 ID - 1509.01186 ER -