TY - RPRT TI - On Lower Bounds for Regret in Reinforcement Learning AU - Ian Osband AU - Benjamin Van Roy PY - 2016 UR - https://arxiv.org/abs/1608.02732 ID - 1608.02732 ER -