@misc{indiciae6d43309502e4, title = {JavisGPT: A Unified Multi-modal LLM for Sounding-Video Comprehension and Generation}, author = {Kai Liu and Jungang Li and Yuchong Sun and Shengqiong Wu and Jianzhang Gao and Daoan Zhang and Wei Zhang and Sheng Jin and Sicheng Yu and Geng Zhan and Jiayi Ji and Fan Zhou and Liang Zheng and Shuicheng Yan and Hao Fei and Tat-Seng Chua}, year = {2026}, url = {https://arxiv.org/abs/2512.22905}, note = {Source identifier: 2512.22905} }