TY - RPRT TI - Multi-objective Reinforcement Learning With Augmented States Requires Rewards After Deployment AU - Peter Vamplew AU - Cameron Foale PY - 2026 UR - https://arxiv.org/abs/2604.15757 ID - 2604.15757 ER -