TY - RPRT TI - Mean-Variance Policy Iteration for Risk-Averse Reinforcement Learning AU - Shangtong Zhang AU - Bo Liu AU - Shimon Whiteson PY - 2022 UR - https://arxiv.org/abs/2004.10888 ID - 2004.10888 ER -