TY - RPRT TI - Multi-Fidelity Hybrid Reinforcement Learning via Information Gain Maximization AU - Houssem Sifaou AU - Osvaldo Simeone PY - 2025 UR - https://arxiv.org/abs/2509.14848 ID - 2509.14848 ER -