@misc{indiciae671f4de67112, title = {VidCoM: Fast Video Comprehension through Large Language Models with Multimodal Tools}, author = {Ji Qi and Kaixuan Ji and Jifan Yu and Duokang Wang and Bin Xu and Lei Hou and Juanzi Li}, year = {2024}, url = {https://arxiv.org/abs/2310.10586}, note = {Source identifier: 2310.10586} }