@misc{indiciae345505abfc54, title = {SlowFast-LLaVA-1.5: A Family of Token-Efficient Video Large Language Models for Long-Form Video Understanding}, author = {Mingze Xu and Mingfei Gao and Shiyu Li and Jiasen Lu and Zhe Gan and Zhengfeng Lai and Meng Cao and Kai Kang and Yinfei Yang and Afshin Dehghan}, year = {2025}, url = {https://arxiv.org/abs/2503.18943}, note = {Source identifier: 2503.18943} }