TY - RPRT TI - Deterministic Pareto-Optimal Policy Synthesis for Multi-Objective Reinforcement Learning AU - Aniruddha Joshi AU - Niklas Lauffer AU - Sanjit Seshia PY - 2026 UR - https://arxiv.org/abs/2606.26397 ID - 2606.26397 ER -