@misc{indiciae81a5e729ca18, title = {SLAM-LLM: A Modular, Open-Source Multimodal Large Language Model Framework and Best Practice for Speech, Language, Audio and Music Processing}, author = {Ziyang Ma and Guanrou Yang and Wenxi Chen and Zhifu Gao and Yexing Du and Xiquan Li and Zhisheng Zheng and Haina Zhu and Jianheng Zhuo and Zheshu Song and Ruiyang Xu and Tiranrui Wang and Yifan Yang and Yanqiao Zhu and Zhikang Niu and Liumeng Xue and Yinghao Ma and Ruibin Yuan and Shiliang Zhang and Kai Yu and Eng Siong Chng and Xie Chen}, year = {2026}, doi = {10.1109/jstsp.2026.3653157}, url = {https://arxiv.org/abs/2601.09385}, note = {Source identifier: 2601.09385} }