@misc{indiciae5921d3bc155b, title = {Temporal Grounding as a Learning Signal for Referring Video Object Segmentation}, author = {Seunghun Lee and Jiwan Seo and Jeonghoon Kim and Sungho Moon and Siwon Kim and Haeun Yun and Hyogyeong Jeon and Wonhyeok Choi and Jaehoon Jeong and Zane Durante and Sang Hyun Park and Sunghoon Im}, year = {2025}, url = {https://arxiv.org/abs/2508.11955}, note = {Source identifier: 2508.11955} }