@misc{indiciaeffcd3d3d2535, title = {From Flatland to Space: Teaching Vision-Language Models to Perceive and Reason in 3D}, author = {Jiahui Zhang and Yurui Chen and Yanpeng Zhou and Yueming Xu and Ze Huang and Jilin Mei and Junhui Chen and Yu-Jie Yuan and Xinyue Cai and Guowei Huang and Xingyue Quan and Hang Xu and Li Zhang}, year = {2026}, url = {https://arxiv.org/abs/2503.22976}, note = {Source identifier: 2503.22976} }