@misc{indiciaeba911d3c814b, title = {GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond}, author = {Anna-Maria Halacheva and Jan-Nico Zaech and Xi Wang and Danda Pani Paudel and Luc Van Gool}, year = {2025}, url = {https://arxiv.org/abs/2507.00886}, note = {Source identifier: 2507.00886} }