TY - RPRT TI - Inverse Reinforcement Learning without an Optimal Demonstrator: A Feasible Reward Set Approach AU - Kihyun Kim AU - Shripad Deshmukh AU - Nikos Vlassis AU - Jiawei Zhang PY - 2026 UR - https://arxiv.org/abs/2605.30903 ID - 2605.30903 ER -