TY - RPRT TI - SA-IGA: A Multiagent Reinforcement Learning Method Towards Socially Optimal Outcomes AU - Chengwei Zhang AU - Xiaohong Li AU - Jianye Hao AU - Siqi Chen AU - Karl Tuyls AU - Wanli Xue PY - 2018 UR - https://arxiv.org/abs/1803.03021 ID - 1803.03021 ER -