@misc{indiciaefbd5715fd0d6, title = {video-SALMONN-o1: Reasoning-enhanced Audio-visual Large Language Model}, author = {Guangzhi Sun and Yudong Yang and Jimin Zhuang and Changli Tang and Yixuan Li and Wei Li and Zejun MA and Chao Zhang}, year = {2025}, url = {https://arxiv.org/abs/2502.11775}, note = {Source identifier: 2502.11775} }