TY - RPRT TI - Mean-Semivariance Policy Optimization via Risk-Averse Reinforcement Learning AU - Xiaoteng Ma AU - Shuai Ma AU - Li Xia AU - Qianchuan Zhao PY - 2023 DO - 10.1613/jair.1.13833 UR - https://arxiv.org/abs/2206.07376 ID - 2206.07376 ER -