TY - RPRT TI - Beyond Pairwise Preferences: Listwise Reward-Aware Alignment for Diffusion Models AU - Austin Wang AU - Jiaqi Han AU - Stefano Ermon AU - Yisong Yue PY - 2026 UR - https://arxiv.org/abs/2605.26491 ID - 2605.26491 ER -