TY - RPRT TI - Multimodal Large Language Model is a Human-Aligned Annotator for Text-to-Image Generation AU - Xun Wu AU - Shaohan Huang AU - Furu Wei PY - 2024 UR - https://arxiv.org/abs/2404.15100 ID - 2404.15100 ER -