TY - RPRT TI - Trust Region Inverse Reinforcement Learning: Explicit Dual Ascent using Local Policy Updates AU - Anish Diwan AU - Davide Tateo AU - Christopher E. Mower AU - Haitham Bou-Ammar AU - Jan Peters AU - Oleg Arenz PY - 2026 UR - https://arxiv.org/abs/2605.11020 ID - 2605.11020 ER -