TY - RPRT TI - Policy Evaluation and Seeking for Multi-Agent Reinforcement Learning via Best Response AU - Rui Yan AU - Xiaoming Duan AU - Zongying Shi AU - Yisheng Zhong AU - Jason R. Marden AU - Francesco Bullo PY - 2020 UR - https://arxiv.org/abs/2006.09585 ID - 2006.09585 ER -