TY - RPRT TI - Learning to Optimize via Information-Directed Sampling AU - Daniel Russo AU - Benjamin Van Roy PY - 2017 UR - https://arxiv.org/abs/1403.5556 ID - 1403.5556 ER -