TY - RPRT TI - Breaking the Curse of Many Agents: Provable Mean Embedding Q-Iteration for Mean-Field Reinforcement Learning AU - Lingxiao Wang AU - Zhuoran Yang AU - Zhaoran Wang PY - 2020 UR - https://arxiv.org/abs/2006.11917 ID - 2006.11917 ER -