@misc{indiciaeda40c332e657, title = {Cross-Modal and Uncertainty-Aware Agglomeration for Open-Vocabulary 3D Scene Understanding}, author = {Jinlong Li and Cristiano Saltori and Fabio Poiesi and Nicu Sebe}, year = {2025}, url = {https://arxiv.org/abs/2503.16707}, note = {Source identifier: 2503.16707} }