TY - RPRT TI - Learning Pareto-Optimal Rewards from Noisy Preferences: A Framework for Multi-Objective Inverse Reinforcement Learning AU - Kalyan Cherukuri AU - Aarav Lala PY - 2025 UR - https://arxiv.org/abs/2505.11864 ID - 2505.11864 ER -