TY - RPRT TI - Multi-Agent Reinforcement Learning for Unmanned Aerial Vehicle Coordination by Multi-Critic Policy Gradient Optimization AU - Yoav Alon AU - Huiyu Zhou PY - 2020 UR - https://arxiv.org/abs/2012.15472 ID - 2012.15472 ER -