TY - RPRT TI - Inverse Reinforcement Learning via Convex Optimization AU - Hao Zhu AU - Yuan Zhang AU - Joschka Boedecker PY - 2025 UR - https://arxiv.org/abs/2501.15957 ID - 2501.15957 ER -