TY - RPRT TI - Decentralized Best-Response-Based Learning in Two-Player Zero-Sum Stochastic Games: A Finite-Sample Analysis AU - Zaiwei Chen AU - Kaiqing Zhang AU - Eric Mazumdar AU - Asuman Ozdaglar AU - Adam Wierman PY - 2026 UR - https://arxiv.org/abs/2409.01447 ID - 2409.01447 ER -