@misc{indiciaee40a42f33fe6, title = {FiT: Flexible Vision Transformer for Diffusion Model}, author = {Zeyu Lu and Zidong Wang and Di Huang and Chengyue Wu and Xihui Liu and Wanli Ouyang and Lei Bai}, year = {2024}, url = {https://arxiv.org/abs/2402.12376}, note = {Source identifier: 2402.12376} }