@misc{indiciae7f489db029be, title = {Balance Reward and Safety Optimization for Safe Reinforcement Learning: A Perspective of Gradient Manipulation}, author = {Shangding Gu and Bilgehan Sel and Yuhao Ding and Lu Wang and Qingwei Lin and Ming Jin and Alois Knoll}, year = {2025}, url = {https://arxiv.org/abs/2405.01677}, note = {Source identifier: 2405.01677} }