@misc{indiciae181b72a2ef8a, title = {SceneVerse: Scaling 3D Vision-Language Learning for Grounded Scene Understanding}, author = {Baoxiong Jia and Yixin Chen and Huangyue Yu and Yan Wang and Xuesong Niu and Tengyu Liu and Qing Li and Siyuan Huang}, year = {2024}, url = {https://arxiv.org/abs/2401.09340}, note = {Source identifier: 2401.09340} }