TY - RPRT TI - Risk-Sensitive Reinforcement Learning: Near-Optimal Risk-Sample Tradeoff in Regret AU - Yingjie Fei AU - Zhuoran Yang AU - Yudong Chen AU - Zhaoran Wang AU - Qiaomin Xie PY - 2020 UR - https://arxiv.org/abs/2006.13827 ID - 2006.13827 ER -