TY - RPRT TI - SpatialVLM: Endowing Vision-Language Models with Spatial Reasoning Capabilities AU - Boyuan Chen AU - Zhuo Xu AU - Sean Kirmani AU - Brian Ichter AU - Danny Driess AU - Pete Florence AU - Dorsa Sadigh AU - Leonidas Guibas AU - Fei Xia PY - 2024 UR - https://arxiv.org/abs/2401.12168 ID - 2401.12168 ER -