TY - RPRT TI - Variational Policy Propagation for Multi-agent Reinforcement Learning AU - Chao Qu AU - Hui Li AU - Chang Liu AU - Junwu Xiong AU - James Zhang AU - Wei Chu AU - Weiqiang Wang AU - Yuan Qi AU - Le Song PY - 2022 UR - https://arxiv.org/abs/2004.08883 ID - 2004.08883 ER -