TY - RPRT TI - ChatGLM-RLHF: Practices of Aligning Large Language Models with Human Feedback AU - Zhenyu Hou AU - Yilin Niu AU - Zhengxiao Du AU - Xiaohan Zhang AU - Xiao Liu AU - Aohan Zeng AU - Qinkai Zheng AU - Minlie Huang AU - Hongning Wang AU - Jie Tang AU - Yuxiao Dong PY - 2024 UR - https://arxiv.org/abs/2404.00934 ID - 2404.00934 ER -