TY - RPRT TI - Conservative and Risk-Aware Offline Multi-Agent Reinforcement Learning AU - Eslam Eldeeb AU - Houssem Sifaou AU - Osvaldo Simeone AU - Mohammad Shehab AU - Hirley Alves PY - 2024 DO - 10.1109/tccn.2024.3499357 UR - https://arxiv.org/abs/2402.08421 ID - 2402.08421 ER -