TY - RPRT TI - Exponential Bellman Equation and Improved Regret Bounds for Risk-Sensitive Reinforcement Learning AU - Yingjie Fei AU - Zhuoran Yang AU - Yudong Chen AU - Zhaoran Wang PY - 2021 UR - https://arxiv.org/abs/2111.03947 ID - 2111.03947 ER -