TY - RPRT TI - Vector-Valued Distributional Reinforcement Learning Policy Evaluation: A Hilbert Space Embedding Approach AU - Mehrdad Mohammadi AU - Qi Zheng AU - Ruoqing Zhu PY - 2026 UR - https://arxiv.org/abs/2601.18952 ID - 2601.18952 ER -