TY - RPRT TI - Using Human Feedback to Fine-tune Diffusion Models without Any Reward Model AU - Kai Yang AU - Jian Tao AU - Jiafei Lyu AU - Chunjiang Ge AU - Jiaxin Chen AU - Qimai Li AU - Weihan Shen AU - Xiaolong Zhu AU - Xiu Li PY - 2024 UR - https://arxiv.org/abs/2311.13231 ID - 2311.13231 ER -