TY - RPRT TI - QVMix and QVMix-Max: Extending the Deep Quality-Value Family of Algorithms to Cooperative Multi-Agent Reinforcement Learning AU - Pascal Leroy AU - Damien Ernst AU - Pierre Geurts AU - Gilles Louppe AU - Jonathan Pisane AU - Matthia Sabatelli PY - 2020 UR - https://arxiv.org/abs/2012.12062 ID - 2012.12062 ER -