TY - RPRT TI - Feasible Policy Iteration for Safe Reinforcement Learning AU - Yujie Yang AU - Zhilong Zheng AU - Shengbo Eben Li AU - Wei Xu AU - Jingjing Liu AU - Xianyuan Zhan AU - Ya-Qin Zhang PY - 2025 UR - https://arxiv.org/abs/2304.08845 ID - 2304.08845 ER -