@misc{indiciaee3602c845d3b, title = {Decentralized Optimistic Hyperpolicy Mirror Descent: Provably No-Regret Learning in Markov Games}, author = {Wenhao Zhan and Jason D. Lee and Zhuoran Yang}, year = {2022}, url = {https://arxiv.org/abs/2206.01588}, note = {Source identifier: 2206.01588} }