@misc{indiciae486d81a60270, title = {LongVLM: Efficient Long Video Understanding via Large Language Models}, author = {Yuetian Weng and Mingfei Han and Haoyu He and Xiaojun Chang and Bohan Zhuang}, year = {2024}, url = {https://arxiv.org/abs/2404.03384}, note = {Source identifier: 2404.03384} }