TY - RPRT TI - Sample Complexity of Average-Reward Q-Learning: From Single-agent to Federated Reinforcement Learning AU - Yuchen Jiao AU - Jiin Woo AU - Gen Li AU - Gauri Joshi AU - Yuejie Chi PY - 2026 UR - https://arxiv.org/abs/2601.13642 ID - 2601.13642 ER -