TY - RPRT TI - Generalizing Behavior via Inverse Reinforcement Learning with Closed-Form Reward Centroids AU - Filippo Lazzati AU - Alberto Maria Metelli PY - 2025 UR - https://arxiv.org/abs/2509.12010 ID - 2509.12010 ER -