@misc{indiciae295a98a7dc39, title = {MM-Diffusion: Learning Multi-Modal Diffusion Models for Joint Audio and Video Generation}, author = {Ludan Ruan and Yiyang Ma and Huan Yang and Huiguo He and Bei Liu and Jianlong Fu and Nicholas Jing Yuan and Qin Jin and Baining Guo}, year = {2023}, url = {https://arxiv.org/abs/2212.09478}, note = {Source identifier: 2212.09478} }