TY - RPRT TI - Counterfactual Conservative Q Learning for Offline Multi-agent Reinforcement Learning AU - Jianzhun Shao AU - Yun Qu AU - Chen Chen AU - Hongchang Zhang AU - Xiangyang Ji PY - 2023 UR - https://arxiv.org/abs/2309.12696 ID - 2309.12696 ER -