@misc{indiciae638bb4e6c8a1, title = {Empowering Global Voices: A Data-Efficient, Phoneme-Tone Adaptive Approach to High-Fidelity Speech Synthesis}, author = {Yizhong Geng and Jizhuo Xu and Zeyu Liang and Jinghan Yang and Xiaoyi Shi and Xiaoyu Shen}, year = {2025}, url = {https://arxiv.org/abs/2504.07858}, note = {Source identifier: 2504.07858} }