@misc{indiciae1ebfffe134f5, title = {Achieving Zero Constraint Violation for Constrained Reinforcement Learning via Conservative Natural Policy Gradient Primal-Dual Algorithm}, author = {Qinbo Bai and Amrit Singh Bedi and Vaneet Aggarwal}, year = {2024}, url = {https://arxiv.org/abs/2206.05850}, note = {Source identifier: 2206.05850} }