@misc{indiciae900f24569a63, title = {Vision language models are unreliable at trivial spatial cognition}, author = {Sangeet Khemlani and Tyler Tran and Nathaniel Gyory and Anthony M. Harrison and Wallace E. Lawson and Ravenna Thielstrom and Hunter Thompson and Taaren Singh and J. Gregory Trafton}, year = {2025}, url = {https://arxiv.org/abs/2504.16061}, note = {Source identifier: 2504.16061} }