@misc{indiciae0689d5e62b3e, title = {Enhancing Long Video Question Answering with Scene-Localized Frame Grouping}, author = {Xuyi Yang and Wenhao Zhang and Hongbo Jin and Lin Liu and Hongbo Xu and Yongwei Nie and Fei Yu and Fei Ma}, year = {2025}, url = {https://arxiv.org/abs/2508.03009}, note = {Source identifier: 2508.03009} }