TY - RPRT TI - Generating diverse and natural text-to-speech samples using a quantized fine-grained VAE and auto-regressive prosody prior AU - Guangzhi Sun AU - Yu Zhang AU - Ron J. Weiss AU - Yuan Cao AU - Heiga Zen AU - Andrew Rosenberg AU - Bhuvana Ramabhadran AU - Yonghui Wu PY - 2020 UR - https://arxiv.org/abs/2002.03788 ID - 2002.03788 ER -