TY - RPRT TI - Finite-sample Guarantees for Nash Q-learning with Linear Function Approximation AU - Pedro Cisneros-Velarde AU - Sanmi Koyejo PY - 2023 UR - https://arxiv.org/abs/2303.00177 ID - 2303.00177 ER -