TY - RPRT TI - Inferring Preferences from Demonstrations in Multi-objective Reinforcement Learning AU - Junlin Lu AU - Patrick Mannion AU - Karl Mason PY - 2024 DO - 10.1007/s00521-024-10412-x UR - https://arxiv.org/abs/2409.20258 ID - 2409.20258 ER -