@misc{indiciae84d20ea38424, title = {Contextual Observer Grounding: Evaluating Situated Spatial Reasoning in Vision-Language Models}, author = {Mimo Shirasaka and Haochen Zhang and Yonatan Bisk}, year = {2026}, url = {https://arxiv.org/abs/2609.06880}, note = {Source identifier: 2609.06880} }