@misc{indiciae128dfa6e8b1a, title = {MeViS: A Multi-Modal Dataset for Referring Motion Expression Video Segmentation}, author = {Henghui Ding and Chang Liu and Shuting He and Kaining Ying and Xudong Jiang and Chen Change Loy and Yu-Gang Jiang}, year = {2025}, doi = {10.1109/tpami.2025.3600507}, url = {https://arxiv.org/abs/2512.10945}, note = {Source identifier: 2512.10945} }