TY - RPRT TI - Confidence-aware Reward Optimization for Fine-tuning Text-to-Image Models AU - Kyuyoung Kim AU - Jongheon Jeong AU - Minyong An AU - Mohammad Ghavamzadeh AU - Krishnamurthy Dvijotham AU - Jinwoo Shin AU - Kimin Lee PY - 2024 UR - https://arxiv.org/abs/2404.01863 ID - 2404.01863 ER -