TY - RPRT TI - Faster Last-iterate Convergence of Policy Optimization in Zero-Sum Markov Games AU - Shicong Cen AU - Yuejie Chi AU - Simon S. Du AU - Lin Xiao PY - 2022 UR - https://arxiv.org/abs/2210.01050 ID - 2210.01050 ER -