@misc{indiciaeabfe8e571204, title = {VideoLLM-MoD: Efficient Video-Language Streaming with Mixture-of-Depths Vision Computation}, author = {Shiwei Wu and Joya Chen and Kevin Qinghong Lin and Qimeng Wang and Yan Gao and Qianli Xu and Tong Xu and Yao Hu and Enhong Chen and Mike Zheng Shou}, year = {2024}, url = {https://arxiv.org/abs/2408.16730}, note = {Source identifier: 2408.16730} }