TY - RPRT TI - Safety Optimized Reinforcement Learning via Multi-Objective Policy Optimization AU - Homayoun Honari AU - Mehran Ghafarian Tamizi AU - Homayoun Najjaran PY - 2024 DO - 10.1109/icra57147.2024.10611316 UR - https://arxiv.org/abs/2402.15197 ID - 2402.15197 ER -