TY - RPRT TI - Hierarchical Message-Passing Policies for Multi-Agent Reinforcement Learning AU - Tommaso Marzi AU - Cesare Alippi AU - Andrea Cini PY - 2026 UR - https://arxiv.org/abs/2507.23604 ID - 2507.23604 ER -