TY - RPRT TI - Last-Iterate Global Convergence of Policy Gradients for Constrained Reinforcement Learning AU - Alessandro Montenegro AU - Marco Mussi AU - Matteo Papini AU - Alberto Maria Metelli PY - 2024 UR - https://arxiv.org/abs/2407.10775 ID - 2407.10775 ER -