@misc{indiciae133036645552, title = {Towards General Auditory Intelligence: Large Multimodal Models for Machine Listening and Speaking}, author = {Siyin Wang and Zengrui Jin and Changli Tang and Qiujia Li and Bo Li and Chen Chen and Yuchen Hu and Wenyi Yu and Yixuan Li and Jimin Zhuang and Yudong Yang and Mingqiu Wang and Michael Han and Yifan Ding and Junwen Bai and Tom Ouyang and Shuo-yiin Chang and Xianzhao Chen and Xiaohai Tian and Jun Zhang and Lu Lu and Guangzhi Sun and Zhehuai Chen and Ji Wu and Bowen Zhou and Yuxuan Wang and Tara Sainath and Yonghui Wu and Chao Zhang}, year = {2025}, url = {https://arxiv.org/abs/2511.01299}, note = {Source identifier: 2511.01299} }