TY - RPRT TI - Optimal Regret Analysis of Thompson Sampling in Stochastic Multi-armed Bandit Problem with Multiple Plays AU - Junpei Komiyama AU - Junya Honda AU - Hiroshi Nakagawa PY - 2019 UR - https://arxiv.org/abs/1506.00779 ID - 1506.00779 ER -