TY - RPRT TI - Trust Region Policy Optimisation in Multi-Agent Reinforcement Learning AU - Jakub Grudzien Kuba AU - Ruiqing Chen AU - Muning Wen AU - Ying Wen AU - Fanglei Sun AU - Jun Wang AU - Yaodong Yang PY - 2022 UR - https://arxiv.org/abs/2109.11251 ID - 2109.11251 ER -