TY - RPRT TI - Improving Generalization of Alignment with Human Preferences through Group Invariant Learning AU - Rui Zheng AU - Wei Shen AU - Yuan Hua AU - Wenbin Lai AU - Shihan Dou AU - Yuhao Zhou AU - Zhiheng Xi AU - Xiao Wang AU - Haoran Huang AU - Tao Gui AU - Qi Zhang AU - Xuanjing Huang PY - 2023 UR - https://arxiv.org/abs/2310.11971 ID - 2310.11971 ER -