@misc{indiciaeced11e4f7a13, title = {M3: High-fidelity Text-to-Image Generation via Multi-Modal, Multi-Agent and Multi-Round Visual Reasoning}, author = {Bangji Yang and Ruihan Guo and Jiajun Fan and Chaoran Cheng and Ge Liu}, year = {2026}, url = {https://arxiv.org/abs/2602.06166}, note = {Source identifier: 2602.06166} }