@misc{indiciae39f8cfd5230e, title = {Efficient Off-Policy Safe Reinforcement Learning Using Trust Region Conditional Value at Risk}, author = {Dohyeong Kim and Songhwai Oh}, year = {2023}, doi = {10.1109/lra.2022.3184793}, url = {https://arxiv.org/abs/2312.00342}, note = {Source identifier: 2312.00342} }