@misc{indiciae5bb51b2e7973, title = {Beyond Single Frames: Can LMMs Comprehend Temporal and Contextual Narratives in Image Sequences?}, author = {Xiaochen Wang and Heming Xia and Jialin Song and Longyu Guan and Yixin Yang and Qingxiu Dong and Weiyao Luo and Yifan Pu and Yiru Wang and Xiangdi Meng and Wenjie Li and Zhifang Sui}, year = {2025}, url = {https://arxiv.org/abs/2502.13925}, note = {Source identifier: 2502.13925} }