@misc{indiciae48159c49be0d, title = {Learning utterance-level representations through token-level acoustic latents prediction for Expressive Speech Synthesis}, author = {Karolos Nikitaras and Konstantinos Klapsas and Nikolaos Ellinas and Georgia Maniati and June Sig Sung and Inchul Hwang and Spyros Raptis and Aimilios Chalamandaris and Pirros Tsiakoulis}, year = {2022}, url = {https://arxiv.org/abs/2211.00523}, note = {Source identifier: 2211.00523} }