@misc{indiciaece8ff650e890, title = {Show Me When and Where: Towards Referring Video Object Segmentation in the Wild}, author = {Mingqi Gao and Jinyu Yang and Jingnan Luo and Xiantong Zhen and Jungong Han and Giovanni Montana and Feng Zheng}, year = {2026}, url = {https://arxiv.org/abs/2603.14300}, note = {Source identifier: 2603.14300} }