@misc{indiciae457abf40f784, title = {OpenOmni: Advancing Open-Source Omnimodal Large Language Models with Progressive Multimodal Alignment and Real-Time Self-Aware Emotional Speech Synthesis}, author = {Run Luo and Ting-En Lin and Haonan Zhang and Yuchuan Wu and Xiong Liu and Min Yang and Yongbin Li and Longze Chen and Jiaming Li and Lei Zhang and Xiaobo Xia and Hamid Alinejad-Rokny and Fei Huang}, year = {2025}, url = {https://arxiv.org/abs/2501.04561}, note = {Source identifier: 2501.04561} }