TY - RPRT TI - Model-based Reinforcement Learning and the Eluder Dimension AU - Ian Osband AU - Benjamin Van Roy PY - 2014 UR - https://arxiv.org/abs/1406.1853 ID - 1406.1853 ER -