TY - RPRT TI - Model-Free Mean-Field Reinforcement Learning: Mean-Field MDP and Mean-Field Q-Learning AU - René Carmona AU - Mathieu Laurière AU - Zongjun Tan PY - 2021 UR - https://arxiv.org/abs/1910.12802 ID - 1910.12802 ER -