TY - RPRT TI - Optimizing Reinforcement Learning Training over Digital Twin Enabled Multi-fidelity Networks AU - Hanzhi Yu AU - Hasan Farooq AU - Julien Forgeat AU - Shruti Bothe AU - Kristijonas Cyras AU - Md Moin Uddin Chowdhury AU - Mingzhe Chen PY - 2026 UR - https://arxiv.org/abs/2603.08931 ID - 2603.08931 ER -