TY - RPRT TI - MMD-MIX: Value Function Factorisation with Maximum Mean Discrepancy for Cooperative Multi-Agent Reinforcement Learning AU - Zhiwei Xu AU - Dapeng Li AU - Yunpeng Bai AU - Guoliang Fan PY - 2021 UR - https://arxiv.org/abs/2106.11652 ID - 2106.11652 ER -