@misc{indiciae309415a1233c, title = {GAP-MLLM: Geometry-Aligned Pre-training for Activating 3D Spatial Perception in Multimodal Large Language Models}, author = {Jiaxin Zhang and Junjun Jiang and Haijie Li and Youyu Chen and Kui Jiang and Dave Zhenyu Chen}, year = {2026}, url = {https://arxiv.org/abs/2603.16461}, note = {Source identifier: 2603.16461} }