@misc{indiciae651cdf908c9c, title = {NaturalSpeech 3: Zero-Shot Speech Synthesis with Factorized Codec and Diffusion Models}, author = {Zeqian Ju and Yuancheng Wang and Kai Shen and Xu Tan and Detai Xin and Dongchao Yang and Yanqing Liu and Yichong Leng and Kaitao Song and Siliang Tang and Zhizheng Wu and Tao Qin and Xiang-Yang Li and Wei Ye and Shikun Zhang and Jiang Bian and Lei He and Jinyu Li and Sheng Zhao}, year = {2024}, url = {https://arxiv.org/abs/2403.03100}, note = {Source identifier: 2403.03100} }