TY - RPRT TI - Kernel-Based Function Approximation for Average Reward Reinforcement Learning: An Optimist No-Regret Algorithm AU - Sattar Vakili AU - Julia Olkhovskaya PY - 2024 UR - https://arxiv.org/abs/2410.23498 ID - 2410.23498 ER -