TY - RPRT TI - DCIR: Dynamic Consistency Intrinsic Reward for Multi-Agent Reinforcement Learning AU - Kunyang Lin AU - Yufeng Wang AU - Peihao Chen AU - Runhao Zeng AU - Siyuan Zhou AU - Mingkui Tan AU - Chuang Gan PY - 2023 UR - https://arxiv.org/abs/2312.05783 ID - 2312.05783 ER -