TY - RPRT TI - Finite-Sample Convergence Bounds for Trust Region Policy Optimization in Mean-Field Games AU - Antonio Ocello AU - Daniil Tiapkin AU - Lorenzo Mancini AU - Mathieu Laurière AU - Eric Moulines PY - 2025 UR - https://arxiv.org/abs/2505.22781 ID - 2505.22781 ER -