@misc{indiciaeaa53723fc774, title = {FocusDiff: Advancing Fine-Grained Text-Image Alignment for Autoregressive Visual Generation through RL}, author = {Kaihang Pan and Wendong Bu and Yuruo Wu and Yang Wu and Kai Shen and Yunfei Li and Hang Zhao and Juncheng Li and Siliang Tang and Yueting Zhuang}, year = {2025}, url = {https://arxiv.org/abs/2506.05501}, note = {Source identifier: 2506.05501} }