@misc{indiciaee117b96539bf, title = {Human-in-the-Loop Policy Optimization for Preference-Based Multi-Objective Reinforcement Learning}, author = {Ke Li and Han Guo}, year = {2024}, url = {https://arxiv.org/abs/2401.02160}, note = {Source identifier: 2401.02160} }