TY - RPRT TI - Wasserstein Formulation of Reinforcement Learning. An Optimal Transport Perspective on Policy Optimization AU - Mathias Dus PY - 2026 UR - https://arxiv.org/abs/2604.14765 ID - 2604.14765 ER -