TY - RPRT TI - Opponent Modeling in Deep Reinforcement Learning AU - He He AU - Jordan Boyd-Graber AU - Kevin Kwok AU - Hal Daumé III PY - 2016 UR - https://arxiv.org/abs/1609.05559 ID - 1609.05559 ER -