@misc{indiciae5de65ef2f4fc, title = {Audio-Visual Segmentation via Depth-Guided Collaborative Modeling}, author = {Zhaojin Fu and Yuyang Hong and Qi Yang and Zili Wang and Kun Ding and Shiming Xiang and Bin Fan}, year = {2026}, doi = {10.1109/tmm.2026.3705199}, url = {https://arxiv.org/abs/2608.16285}, note = {Source identifier: 2608.16285} }