TY - RPRT TI - Kernelized Reinforcement Learning with Order Optimal Regret Bounds AU - Sattar Vakili AU - Julia Olkhovskaya PY - 2024 UR - https://arxiv.org/abs/2306.07745 ID - 2306.07745 ER -