TY - RPRT TI - FedHPD: Heterogeneous Federated Reinforcement Learning via Policy Distillation AU - Wenzheng Jiang AU - Ji Wang AU - Xiongtao Zhang AU - Weidong Bao AU - Cheston Tan AU - Flint Xiaofeng Fan PY - 2025 UR - https://arxiv.org/abs/2502.00870 ID - 2502.00870 ER -