@misc{indiciaee30e016c76bc, title = {End-to-End Text-to-Speech using Latent Duration based on VQ-VAE}, author = {Yusuke Yasuda and Xin Wang and Junichi Yamagishi}, year = {2020}, url = {https://arxiv.org/abs/2010.09602}, note = {Source identifier: 2010.09602} }