@misc{indiciaeda745872c115, title = {UniSonate: A Unified Model for Speech, Music, and Sound Effect Generation with Text Instructions}, author = {Chunyu Qiang and Xiaopeng Wang and Kang Yin and Yuzhe Liang and Yuxin Guo and Teng Ma and Ziyu Zhang and Tianrui Wang and Cheng Gong and Yushen Chen and Ruibo Fu and Chen Zhang and Longbiao Wang and Jianwu Dang}, year = {2026}, url = {https://arxiv.org/abs/2604.22209}, note = {Source identifier: 2604.22209} }