@misc{indiciae6e308508cbd5, title = {Grounded 3D-Aware Spatial Vision-Language Modeling}, author = {An-Chieh Cheng and Yang Fu and Yatai Ji and Ligeng Zhu and Guanqi Zhan and Zhuoyang Zhang and Zhaojing Yang and Song Han and Yao Lu and Pavlo Molchanov and Vidya Nariyambut Murali and Jan Kautz and Xiaolong Wang and Hongxu Yin and Sifei Liu}, year = {2026}, url = {https://arxiv.org/abs/2605.30307}, note = {Source identifier: 2605.30307} }