TY - RPRT TI - Fully Decentralized Cooperative Multi-Agent Reinforcement Learning is A Context Modeling Problem AU - Chao Li AU - Bingkun Bao AU - Yang Gao PY - 2026 UR - https://arxiv.org/abs/2509.15519 ID - 2509.15519 ER -