TY - RPRT TI - From Correspondence to Actions: Human-Like Multi-Image Spatial Reasoning in Multi-modal Large Language Models AU - Masanari Oi AU - Koki Maeda AU - Ryuto Koike AU - Daisuke Oba AU - Nakamasa Inoue AU - Naoaki Okazaki PY - 2026 UR - https://arxiv.org/abs/2602.08735 ID - 2602.08735 ER -