TY - RPRT TI - Centralized Permutation Equivariant Policy for Cooperative Multi-Agent Reinforcement Learning AU - Zhuofan Xu AU - Benedikt Bollig AU - Matthias Függer AU - Thomas Nowak AU - Vincent Le Dréau PY - 2025 UR - https://arxiv.org/abs/2508.11706 ID - 2508.11706 ER -