TY - RPRT TI - OptionGAN: Learning Joint Reward-Policy Options using Generative Adversarial Inverse Reinforcement Learning AU - Peter Henderson AU - Wei-Di Chang AU - Pierre-Luc Bacon AU - David Meger AU - Joelle Pineau AU - Doina Precup PY - 2017 UR - https://arxiv.org/abs/1709.06683 ID - 1709.06683 ER -