TY - RPRT TI - QMAVIS: Long Video-Audio Understanding using Fusion of Large Multimodal Models AU - Zixing Lin AU - Jiale Wang AU - Gee Wah Ng AU - Lee Onn Mak AU - Chan Zhi Yang Jeriel AU - Jun Yang Lee AU - Yaohao Li PY - 2026 UR - https://arxiv.org/abs/2601.06573 ID - 2601.06573 ER -