TY - RPRT TI - Policy Gradients for Cumulative Prospect Theory in Reinforcement Learning AU - Olivier Lepel AU - Anas Barakat PY - 2026 UR - https://arxiv.org/abs/2410.02605 ID - 2410.02605 ER -