TY - RPRT TI - How Exploration Breaks Cooperation in Shared-Policy Multi-Agent Reinforcement Learning AU - Yi-Ning Weng AU - Hsuan-Wei Lee PY - 2026 UR - https://arxiv.org/abs/2601.05509 ID - 2601.05509 ER -