TY - RPRT TI - OpenOmni: Advancing Open-Source Omnimodal Large Language Models with Progressive Multimodal Alignment and Real-Time Self-Aware Emotional Speech Synthesis AU - Run Luo AU - Ting-En Lin AU - Haonan Zhang AU - Yuchuan Wu AU - Xiong Liu AU - Min Yang AU - Yongbin Li AU - Longze Chen AU - Jiaming Li AU - Lei Zhang AU - Xiaobo Xia AU - Hamid Alinejad-Rokny AU - Fei Huang PY - 2025 UR - https://arxiv.org/abs/2501.04561 ID - 2501.04561 ER -