@misc{indiciaebad4bde317fc, title = {From Text to Talk: Audio-Language Model Needs Non-Autoregressive Joint Training}, author = {Tianqiao Liu and Xueyi Li and Hao Wang and Haoxuan Li and Zhichao Chen and Weiqi Luo and Zitao Liu}, year = {2026}, url = {https://arxiv.org/abs/2509.20072}, note = {Source identifier: 2509.20072} }