TY - RPRT TI - Personalized Federated Reinforcement Learning via Model-Agnostic Meta-Learning: Convergence of Exact and Hessian-Free Meta-Policy Gradients AU - Ali Beikmohammadi AU - Sarit Khirirat AU - Sindri Magnússon PY - 2026 UR - https://arxiv.org/abs/2609.22833 ID - 2609.22833 ER -