@misc{indiciaea7c96e568fed, title = {Sounding Video Generator: A Unified Framework for Text-guided Sounding Video Generation}, author = {Jiawei Liu and Weining Wang and Sihan Chen and Xinxin Zhu and Jing Liu}, year = {2023}, doi = {10.1109/tmm.2023.3262180}, url = {https://arxiv.org/abs/2303.16541}, note = {Source identifier: 2303.16541} }