TY - RPRT TI - CRPO: A New Approach for Safe Reinforcement Learning with Convergence Guarantee AU - Tengyu Xu AU - Yingbin Liang AU - Guanghui Lan PY - 2021 UR - https://arxiv.org/abs/2011.05869 ID - 2011.05869 ER -