@misc{indiciae19d71264a45d, title = {From Correspondence to Actions: Human-Like Multi-Image Spatial Reasoning in Multi-modal Large Language Models}, author = {Masanari Oi and Koki Maeda and Ryuto Koike and Daisuke Oba and Nakamasa Inoue and Naoaki Okazaki}, year = {2026}, url = {https://arxiv.org/abs/2602.08735}, note = {Source identifier: 2602.08735} }