@misc{indiciae41b7f0c24f57, title = {Video-Bench: A Comprehensive Benchmark and Toolkit for Evaluating Video-based Large Language Models}, author = {Munan Ning and Bin Zhu and Yujia Xie and Bin Lin and Jiaxi Cui and Lu Yuan and Dongdong Chen and Li Yuan}, year = {2023}, url = {https://arxiv.org/abs/2311.16103}, note = {Source identifier: 2311.16103} }