TY - RPRT TI - Constrained Policy Gradient Method for Safe and Fast Reinforcement Learning: a Neural Tangent Kernel Based Approach AU - Balázs Varga AU - Balázs Kulcsár AU - Morteza Haghir Chehreghani PY - 2022 UR - https://arxiv.org/abs/2107.09139 ID - 2107.09139 ER -