TY - RPRT TI - PRDP: Proximal Reward Difference Prediction for Large-Scale Reward Finetuning of Diffusion Models AU - Fei Deng AU - Qifei Wang AU - Wei Wei AU - Matthias Grundmann AU - Tingbo Hou PY - 2024 UR - https://arxiv.org/abs/2402.08714 ID - 2402.08714 ER -