TY - RPRT TI - Improved Bayesian Regret Bounds for Thompson Sampling in Reinforcement Learning AU - Ahmadreza Moradipari AU - Mohammad Pedramfar AU - Modjtaba Shokrian Zini AU - Vaneet Aggarwal PY - 2024 UR - https://arxiv.org/abs/2310.20007 ID - 2310.20007 ER -