@misc{indiciae8cb604c397d4, title = {CLIP-VIS: Adapting CLIP for Open-Vocabulary Video Instance Segmentation}, author = {Wenqi Zhu and Jiale Cao and Jin Xie and Shuangming Yang and Yanwei Pang}, year = {2024}, url = {https://arxiv.org/abs/2403.12455}, note = {Source identifier: 2403.12455} }