TY - RPRT TI - The Harder Path: Last Iterate Convergence for Uncoupled Learning in Zero-Sum Games with Bandit Feedback AU - Côme Fiegel AU - Pierre Ménard AU - Tadashi Kozuno AU - Michal Valko AU - Vianney Perchet PY - 2026 UR - https://arxiv.org/abs/2604.16087 ID - 2604.16087 ER -