@misc{indiciaef1fa50fe2729, title = {HERO: Human-Feedback Efficient Reinforcement Learning for Online Diffusion Model Finetuning}, author = {Ayano Hiranaka and Shang-Fu Chen and Chieh-Hsin Lai and Dongjun Kim and Naoki Murata and Takashi Shibuya and Wei-Hsiang Liao and Shao-Hua Sun and Yuki Mitsufuji}, year = {2025}, url = {https://arxiv.org/abs/2410.05116}, note = {Source identifier: 2410.05116} }