TY - RPRT TI - DeSTA2.5-Audio: Toward General-Purpose Large Audio Language Model with Self-Generated Cross-Modal Alignment AU - Ke-Han Lu AU - Zhehuai Chen AU - Szu-Wei Fu AU - Chao-Han Huck Yang AU - Sung-Feng Huang AU - Chih-Kai Yang AU - Chee-En Yu AU - Chun-Wei Chen AU - Wei-Chih Chen AU - Chien-yu Huang AU - Yi-Cheng Lin AU - Yu-Xiang Lin AU - Chi-An Fu AU - Chun-Yi Kuan AU - Wenze Ren AU - Xuanjun Chen AU - Wei-Ping Huang AU - En-Pei Hu AU - Tzu-Quan Lin AU - Yuan-Kuei Wu AU - Kuan-Po Huang AU - Hsiao-Ying Huang AU - Huang-Cheng Chou AU - Kai-Wei Chang AU - Cheng-Han Chiang AU - Boris Ginsburg AU - Yu-Chiang Frank Wang AU - Hung-yi Lee PY - 2026 UR - https://arxiv.org/abs/2507.02768 ID - 2507.02768 ER -