@misc{indiciaef39db0603545, title = {M2-CTTS: End-to-End Multi-scale Multi-modal Conversational Text-to-Speech Synthesis}, author = {Jinlong Xue and Yayue Deng and Fengping Wang and Ya Li and Yingming Gao and Jianhua Tao and Jianqing Sun and Jiaen Liang}, year = {2023}, url = {https://arxiv.org/abs/2305.02269}, note = {Source identifier: 2305.02269} }