TY - RPRT TI - Permutation Invariant Policy Optimization for Mean-Field Multi-Agent Reinforcement Learning: A Principled Approach AU - Yan Li AU - Lingxiao Wang AU - Jiachen Yang AU - Ethan Wang AU - Zhaoran Wang AU - Tuo Zhao AU - Hongyuan Zha PY - 2021 UR - https://arxiv.org/abs/2105.08268 ID - 2105.08268 ER -