TY - RPRT TI - Scalable Policy Optimization for Networked Multi-Agent Reinforcement Learning with Continuous State-Action Spaces AU - Dongming Wang AU - Pengcheng Dai AU - Wenwu Yu AU - Wei Ren PY - 2026 UR - https://arxiv.org/abs/2607.18554 ID - 2607.18554 ER -