@misc{indiciae7b1c4cf67234, title = {Learning to Speak from Text: Zero-Shot Multilingual Text-to-Speech with Unsupervised Text Pretraining}, author = {Takaaki Saeki and Soumi Maiti and Xinjian Li and Shinji Watanabe and Shinnosuke Takamichi and Hiroshi Saruwatari}, year = {2023}, url = {https://arxiv.org/abs/2301.12596}, note = {Source identifier: 2301.12596} }