TY - RPRT TI - CODA: Coordination via On-Policy Diffusion for Multi-Agent Offline Reinforcement Learning AU - Marcel Hedman AU - Kale-ab Abebe Tessera AU - Juan Claude Formanek AU - Anya Sims AU - Riccardo Zamboni AU - Trevor McInroe AU - John Torr AU - Elliot Fosong PY - 2026 UR - https://arxiv.org/abs/2604.23308 ID - 2604.23308 ER -