TY - RPRT TI - Provably Efficient Iterated CVaR Reinforcement Learning with Function Approximation and Human Feedback AU - Yu Chen AU - Yihan Du AU - Pihe Hu AU - Siwei Wang AU - Desheng Wu AU - Longbo Huang PY - 2023 UR - https://arxiv.org/abs/2307.02842 ID - 2307.02842 ER -