TY - RPRT TI - (More) Efficient Reinforcement Learning via Posterior Sampling AU - Ian Osband AU - Daniel Russo AU - Benjamin Van Roy PY - 2013 UR - https://arxiv.org/abs/1306.0940 ID - 1306.0940 ER -