TY - RPRT TI - Efficient model-based reinforcement learning for approximate online optimal AU - Rushikesh Kamalapurkar AU - Joel A. Rosenfeld AU - Warren E. Dixon PY - 2015 DO - 10.1016/j.automatica.2016.08.004 UR - https://arxiv.org/abs/1502.02609 ID - 1502.02609 ER -