TY - RPRT TI - Scalable Centralized Deep Multi-Agent Reinforcement Learning via Policy Gradients AU - Arbaaz Khan AU - Clark Zhang AU - Daniel D. Lee AU - Vijay Kumar AU - Alejandro Ribeiro PY - 2018 UR - https://arxiv.org/abs/1805.08776 ID - 1805.08776 ER -