@misc{indiciae17ca94229821, title = {MVGGT: Multimodal Visual Geometry Grounded Transformer for Multiview 3D Referring Expression Segmentation}, author = {Changli Wu and Haodong Wang and Jiayi Ji and Yutian Yao and Chunsai Du and Jihua Kang and Yanwei Fu and Liujuan Cao}, year = {2026}, url = {https://arxiv.org/abs/2601.06874}, note = {Source identifier: 2601.06874} }