@misc{indiciae4d917a5bbad5, title = {MMoT: Mixture-of-Modality-Tokens Transformer for Composed Multimodal Conditional Image Synthesis}, author = {Jianbin Zheng and Daqing Liu and Chaoyue Wang and Minghui Hu and Zuopeng Yang and Changxing Ding and Dacheng Tao}, year = {2023}, url = {https://arxiv.org/abs/2305.05992}, note = {Source identifier: 2305.05992} }