@misc{indiciaebda4f734945e, title = {SpatialRGPT: Grounded Spatial Reasoning in Vision Language Models}, author = {An-Chieh Cheng and Hongxu Yin and Yang Fu and Qiushan Guo and Ruihan Yang and Jan Kautz and Xiaolong Wang and Sifei Liu}, year = {2024}, url = {https://arxiv.org/abs/2406.01584}, note = {Source identifier: 2406.01584} }