TY - RPRT TI - Competitive Multi-agent Inverse Reinforcement Learning with Sub-optimal Demonstrations AU - Xingyu Wang AU - Diego Klabjan PY - 2018 UR - https://arxiv.org/abs/1801.02124 ID - 1801.02124 ER -