@misc{indiciae21ffe695c192, title = {Emu Video: Factorizing Text-to-Video Generation by Explicit Image Conditioning}, author = {Rohit Girdhar and Mannat Singh and Andrew Brown and Quentin Duval and Samaneh Azadi and Sai Saketh Rambhatla and Akbar Shah and Xi Yin and Devi Parikh and Ishan Misra}, year = {2024}, url = {https://arxiv.org/abs/2311.10709}, note = {Source identifier: 2311.10709} }