TY - RPRT TI - Linear-Quadratic Mean-Field Reinforcement Learning: Convergence of Policy Gradient Methods AU - René Carmona AU - Mathieu Laurière AU - Zongjun Tan PY - 2025 UR - https://arxiv.org/abs/1910.04295 ID - 1910.04295 ER -