TY - RPRT TI - HRLAIF: Improvements in Helpfulness and Harmlessness in Open-domain Reinforcement Learning From AI Feedback AU - Ang Li AU - Qiugen Xiao AU - Peng Cao AU - Jian Tang AU - Yi Yuan AU - Zijie Zhao AU - Xiaoyuan Chen AU - Liang Zhang AU - Xiangyang Li AU - Kaitong Yang AU - Weidong Guo AU - Yukang Gan AU - Xu Yu AU - Daniell Wang AU - Ying Shan PY - 2024 UR - https://arxiv.org/abs/2403.08309 ID - 2403.08309 ER -