@misc{indiciae271410fa57b9, title = {CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer}, author = {Zhuoyi Yang and Jiayan Teng and Wendi Zheng and Ming Ding and Shiyu Huang and Jiazheng Xu and Yuanming Yang and Wenyi Hong and Xiaohan Zhang and Guanyu Feng and Da Yin and Yuxuan Zhang and Weihan Wang and Yean Cheng and Bin Xu and Xiaotao Gu and Yuxiao Dong and Jie Tang}, year = {2025}, url = {https://arxiv.org/abs/2408.06072}, note = {Source identifier: 2408.06072} }