@misc{indiciae98954ac93e43, title = {Safe RLHF-V: Safe Reinforcement Learning from Multi-modal Human Feedback}, author = {Jiaming Ji and Xinyu Chen and Rui Pan and Conghui Zhang and Han Zhu and Jiahao Li and Donghai Hong and Boyuan Chen and Jiayi Zhou and Kaile Wang and Juntao Dai and Chi-Min Chan and Yida Tang and Sirui Han and Yike Guo and Yaodong Yang}, year = {2025}, url = {https://arxiv.org/abs/2503.17682}, note = {Source identifier: 2503.17682} }