TY - RPRT TI - Value Enhancement of Reinforcement Learning via Efficient and Robust Trust Region Optimization AU - Chengchun Shi AU - Zhengling Qi AU - Jianing Wang AU - Fan Zhou PY - 2023 UR - https://arxiv.org/abs/2301.02220 ID - 2301.02220 ER -