TY - RPRT TI - Reinforcement Learning for Exponential Utility: Algorithms and Convergence in Discounted MDPs AU - Gugan Thoppe AU - L. A. Prashanth AU - Ankur Naskar AU - Sanjay Bhat PY - 2026 UR - https://arxiv.org/abs/2605.08053 ID - 2605.08053 ER -