@misc{indiciaebc3d2221b657, title = {Can Multimodal Large Language Models Understand Spatial Relations?}, author = {Jingping Liu and Ziyan Liu and Zhedong Cen and Yan Zhou and Yinan Zou and Weiyan Zhang and Haiyun Jiang and Tong Ruan}, year = {2025}, doi = {10.18653/v1/2025.acl-long.31}, url = {https://arxiv.org/abs/2505.19015}, note = {Source identifier: 2505.19015} }