@misc{indiciae6c48588dd710, title = {SpaceMind: Camera-Guided Modality Fusion for Spatial Reasoning in Vision-Language Models}, author = {Ruosen Zhao and Zhikang Zhang and Jialei Xu and Jiahao Chang and Dong Chen and Lingyun Li and Weijian Sun and Zizhuang Wei}, year = {2025}, url = {https://arxiv.org/abs/2511.23075}, note = {Source identifier: 2511.23075} }