@misc{indiciaeba9085f5918d, title = {COMET: Contrastive Motion-Enhanced Temporal Reasoning for Video Multimodal Large Language Models}, author = {Chenghua Zhu and Zhaolu Kang and Qifan Shi and Siyan Wu and Kehan Jiang and Lei Wei and Lianyu Hu and Guangyuan Dong and Mingbo Yang and Rui Lu and Guibo Luo}, year = {2026}, url = {https://arxiv.org/abs/2608.21030}, note = {Source identifier: 2608.21030} }