@misc{indiciaea436fced8302, title = {Audio-centric Video Understanding Benchmark without Text Shortcut}, author = {Yudong Yang and Jimin Zhuang and Guangzhi Sun and Changli Tang and Yixuan Li and Peihan Li and Yifan Jiang and Wei Li and Zejun Ma and Chao Zhang}, year = {2025}, url = {https://arxiv.org/abs/2503.19951}, note = {Source identifier: 2503.19951} }