TY - RPRT TI - Reinforcement Learning in Switching Non-Stationary Markov Decision Processes: Algorithms and Convergence Analysis AU - Mohsen Amiri AU - Sindri Magnússon PY - 2026 UR - https://arxiv.org/abs/2503.18607 ID - 2503.18607 ER -