TY - RPRT TI - Model-Based Reinforcement Learning for Offline Zero-Sum Markov Games AU - Yuling Yan AU - Gen Li AU - Yuxin Chen AU - Jianqing Fan PY - 2024 UR - https://arxiv.org/abs/2206.04044 ID - 2206.04044 ER -