TY - RPRT TI - Towards Cooperation in Sequential Prisoner's Dilemmas: a Deep Multiagent Reinforcement Learning Approach AU - Weixun Wang AU - Jianye Hao AU - Yixi Wang AU - Matthew Taylor PY - 2018 UR - https://arxiv.org/abs/1803.00162 ID - 1803.00162 ER -