@misc{indiciae98c0dec24078, title = {Reward-Augmented Data Enhances Direct Preference Alignment of LLMs}, author = {Shenao Zhang and Zhihan Liu and Boyi Liu and Yufeng Zhang and Yingxiang Yang and Yongfei Liu and Liyu Chen and Tao Sun and Zhaoran Wang}, year = {2025}, url = {https://arxiv.org/abs/2410.08067}, note = {Source identifier: 2410.08067} }