@misc{indiciaee891ebb5fccb, title = {VidText: Towards Comprehensive Evaluation for Video Text Understanding}, author = {Zhoufaran Yang and Yan Shu and Jing Wang and Zhifei Yang and Yan Zhang and Yu Li and Keyang Lu and Gangyan Zeng and Shaohui Liu and Yu Zhou and Nicu Sebe}, year = {2025}, url = {https://arxiv.org/abs/2505.22810}, note = {Source identifier: 2505.22810} }