TY - RPRT TI - Towards Robust Alignment of Language Models: Distributionally Robustifying Direct Preference Optimization AU - Junkang Wu AU - Yuexiang Xie AU - Zhengyi Yang AU - Jiancan Wu AU - Jiawei Chen AU - Jinyang Gao AU - Bolin Ding AU - Xiang Wang AU - Xiangnan He PY - 2025 UR - https://arxiv.org/abs/2407.07880 ID - 2407.07880 ER -