TY - RPRT TI - Reinforcement Learning with General Value Function Approximation: Provably Efficient Approach via Bounded Eluder Dimension AU - Ruosong Wang AU - Ruslan Salakhutdinov AU - Lin F. Yang PY - 2020 UR - https://arxiv.org/abs/2005.10804 ID - 2005.10804 ER -