TY - RPRT TI - A Bandit Learning Method for Continuous Games under Feedback Delays with Residual Pseudo-Gradient Estimate AU - Yuanhanqing Huang AU - Jianghai Hu PY - 2023 UR - https://arxiv.org/abs/2303.16433 ID - 2303.16433 ER -