TY - RPRT TI - Adversarial Learning in Games with Bandit Feedback: Logarithmic Pure-Strategy Maximin Regret AU - Shinji Ito AU - Haipeng Luo AU - Arnab Maiti AU - Taira Tsuchiya AU - Yue Wu PY - 2026 UR - https://arxiv.org/abs/2602.06348 ID - 2602.06348 ER -