@misc{indiciaec5a1442a8a55, title = {Audio-Omni: Extending Multi-modal Understanding to Versatile Audio Generation and Editing}, author = {Zeyue Tian and Binxin Yang and Zhaoyang Liu and Jiexuan Zhang and Ruibin Yuan and Hubery Yin and Qifeng Chen and Chen Li and Jing Lyu and Wei Xue and Yike Guo}, year = {2026}, url = {https://arxiv.org/abs/2604.10708}, note = {Source identifier: 2604.10708} }