@misc{indiciaedd83e03bdae4, title = {Learning Pareto-Optimal Rewards from Noisy Preferences: A Framework for Multi-Objective Inverse Reinforcement Learning}, author = {Kalyan Cherukuri and Aarav Lala}, year = {2025}, url = {https://arxiv.org/abs/2505.11864}, note = {Source identifier: 2505.11864} }