TY - RPRT TI - Maximum Entropy Semi-Supervised Inverse Reinforcement Learning AU - Julien Audiffren AU - Michal Valko AU - Alessandro Lazaric AU - Mohammad Ghavamzadeh PY - 2026 UR - https://arxiv.org/abs/2604.20074 ID - 2604.20074 ER -