TY - RPRT TI - Efficient Reinforcement Learning in Deterministic Systems with Value Function Generalization AU - Zheng Wen AU - Benjamin Van Roy PY - 2016 UR - https://arxiv.org/abs/1307.4847 ID - 1307.4847 ER -