@misc{indiciae81c42db4f181, title = {Hindsight Preference Replay Improves Preference-Conditioned Multi-Objective Reinforcement Learning}, author = {Jonaid Shianifar and Michael Schukat and Karl Mason}, year = {2026}, url = {https://arxiv.org/abs/2601.11604}, note = {Source identifier: 2601.11604} }