TY - RPRT TI - Interpretability by Design for Efficient Multi-Objective Reinforcement Learning AU - Qiyue Xia AU - Tianwei Wang AU - J. Michael Herrmann PY - 2026 UR - https://arxiv.org/abs/2506.04022 ID - 2506.04022 ER -