@misc{indiciaee4d3e0f19642, title = {Reinforcement Learning for Markovian Bandits: Is Posterior Sampling more Scalable than Optimism?}, author = {Nicolas Gast and Bruno Gaujal and Kimang Khun}, year = {2022}, url = {https://arxiv.org/abs/2106.08771}, note = {Source identifier: 2106.08771} }