@misc{indiciaedd88e06c5566, title = {Pref-GRPO: Pairwise Preference Reward-based GRPO for Stable Text-to-Image Reinforcement Learning}, author = {Yibin Wang and Zhimin Li and Yuhang Zang and Yujie Zhou and Jiazi Bu and Chunyu Wang and Qinglin Lu and Cheng Jin and Jiaqi Wang}, year = {2026}, url = {https://arxiv.org/abs/2508.20751}, note = {Source identifier: 2508.20751} }