@misc{indiciaef764ddbe6809, title = {Generating diverse and natural text-to-speech samples using a quantized fine-grained VAE and auto-regressive prosody prior}, author = {Guangzhi Sun and Yu Zhang and Ron J. Weiss and Yuan Cao and Heiga Zen and Andrew Rosenberg and Bhuvana Ramabhadran and Yonghui Wu}, year = {2020}, url = {https://arxiv.org/abs/2002.03788}, note = {Source identifier: 2002.03788} }