@misc{indiciae909035e8f23e, title = {Advancing Speech Language Models by Scaling Supervised Fine-Tuning with Over 60,000 Hours of Synthetic Speech Dialogue Data}, author = {Shuaijiang Zhao and Tingwei Guo and Bajian Xiang and Tongtang Wan and Qiang Niu and Wei Zou and Xiangang Li}, year = {2024}, url = {https://arxiv.org/abs/2412.01078}, note = {Source identifier: 2412.01078} }