TY - RPRT TI - Provably Adaptive Average Reward Reinforcement Learning for Metric Spaces AU - Avik Kar AU - Rahul Singh PY - 2025 UR - https://arxiv.org/abs/2410.19919 ID - 2410.19919 ER -