@misc{indiciae5d9e84411626, title = {NaturalSpeech 2: Latent Diffusion Models are Natural and Zero-Shot Speech and Singing Synthesizers}, author = {Kai Shen and Zeqian Ju and Xu Tan and Yanqing Liu and Yichong Leng and Lei He and Tao Qin and Sheng Zhao and Jiang Bian}, year = {2023}, url = {https://arxiv.org/abs/2304.09116}, note = {Source identifier: 2304.09116} }