TY - RPRT TI - Human-aligned Safe Reinforcement Learning for Highway On-Ramp Merging in Dense Traffic AU - Yang Li AU - Shijie Yuan AU - Yuan Chang AU - Xiaolong Chen AU - Qisong Yang AU - Zhiyuan Yang AU - Hongmao Qin PY - 2025 UR - https://arxiv.org/abs/2503.02624 ID - 2503.02624 ER -