@misc{indiciaec20b0f5d67ab, title = {Video-RAG: Visually-aligned Retrieval-Augmented Long Video Comprehension}, author = {Yongdong Luo and Xiawu Zheng and Guilin Li and Shukang Yin and Haojia Lin and Chaoyou Fu and Jinfa Huang and Jiayi Ji and Fei Chao and Jiebo Luo and Rongrong Ji}, year = {2025}, url = {https://arxiv.org/abs/2411.13093}, note = {Source identifier: 2411.13093} }