@misc{indiciae4436948b6786, title = {Guiding Instruction-based Image Editing via Multimodal Large Language Models}, author = {Tsu-Jui Fu and Wenze Hu and Xianzhi Du and William Yang Wang and Yinfei Yang and Zhe Gan}, year = {2024}, url = {https://arxiv.org/abs/2309.17102}, note = {Source identifier: 2309.17102} }