TY - RPRT TI - A New Framework for Multi-Agent Reinforcement Learning -- Centralized Training and Exploration with Decentralized Execution via Policy Distillation AU - Gang Chen PY - 2019 UR - https://arxiv.org/abs/1910.09152 ID - 1910.09152 ER -