TY - RPRT TI - Risk-sensitive Reinforcement Learning Based on Convex Scoring Functions AU - Shanyu Han AU - Yang Liu AU - Xiang Yu PY - 2025 UR - https://arxiv.org/abs/2505.04553 ID - 2505.04553 ER -