TY - RPRT TI - Policy Optimization Provably Converges to Nash Equilibria in Zero-Sum Linear Quadratic Games AU - Kaiqing Zhang AU - Zhuoran Yang AU - Tamer Başar PY - 2021 UR - https://arxiv.org/abs/1906.00729 ID - 1906.00729 ER -