TY - RPRT TI - Learning Nash Equilibrium for General-Sum Markov Games from Batch Data AU - Julien Pérolat AU - Florian Strub AU - Bilal Piot AU - Olivier Pietquin PY - 2017 UR - https://arxiv.org/abs/1606.08718 ID - 1606.08718 ER -