TY - RPRT TI - Policy Gradient Methods for Risk-Sensitive Distributional Reinforcement Learning with Provable Convergence AU - Minheng Xiao AU - Xian Yu AU - Lei Ying PY - 2025 UR - https://arxiv.org/abs/2405.14749 ID - 2405.14749 ER -