@misc{indiciae2d9cf33f4897, title = {Object-centric Video Question Answering with Visual Grounding and Referring}, author = {Haochen Wang and Qirui Chen and Cilin Yan and Jiayin Cai and Xiaolong Jiang and Yao Hu and Weidi Xie and Stratis Gavves}, year = {2025}, url = {https://arxiv.org/abs/2507.19599}, note = {Source identifier: 2507.19599} }