TY - RPRT TI - The Best of Both Worlds: Reinforcement Learning with Logarithmic Regret and Policy Switches AU - Grigoris Velegkas AU - Zhuoran Yang AU - Amin Karbasi PY - 2022 UR - https://arxiv.org/abs/2203.01491 ID - 2203.01491 ER -