TY - RPRT TI - DPOK: Reinforcement Learning for Fine-tuning Text-to-Image Diffusion Models AU - Ying Fan AU - Olivia Watkins AU - Yuqing Du AU - Hao Liu AU - Moonkyung Ryu AU - Craig Boutilier AU - Pieter Abbeel AU - Mohammad Ghavamzadeh AU - Kangwook Lee AU - Kimin Lee PY - 2023 UR - https://arxiv.org/abs/2305.16381 ID - 2305.16381 ER -