TY - RPRT TI - Variational Bayesian Reinforcement Learning with Regret Bounds AU - Brendan O'Donoghue PY - 2022 UR - https://arxiv.org/abs/1807.09647 ID - 1807.09647 ER -