TY - RPRT TI - Interactive Inverse Reinforcement Learning of Interaction Scenarios via Bi-level Optimization AU - Yue Mao AU - Shicheng Liu AU - Siyuan Xu AU - Minghui Zhu PY - 2026 UR - https://arxiv.org/abs/2605.08131 ID - 2605.08131 ER -