@misc{indiciae1964a33e86c7, title = {SD-VLM: Spatial Measuring and Understanding with Depth-Encoded Vision-Language Models}, author = {Pingyi Chen and Yujing Lou and Shen Cao and Jinhui Guo and Lubin Fan and Yue Wu and Lin Yang and Lizhuang Ma and Jieping Ye}, year = {2025}, url = {https://arxiv.org/abs/2509.17664}, note = {Source identifier: 2509.17664} }