TY - RPRT TI - Tighter Problem-Dependent Regret Bounds in Reinforcement Learning without Domain Knowledge using Value Function Bounds AU - Andrea Zanette AU - Emma Brunskill PY - 2019 UR - https://arxiv.org/abs/1901.00210 ID - 1901.00210 ER -