TY - RPRT TI - $f$-PO: Generalizing Preference Optimization with $f$-divergence Minimization AU - Jiaqi Han AU - Mingjian Jiang AU - Yuxuan Song AU - Stefano Ermon AU - Minkai Xu PY - 2025 UR - https://arxiv.org/abs/2410.21662 ID - 2410.21662 ER -