@misc{indiciaedfcea28e1f2c, title = {Do Vision-Language Models Represent Space and How? Evaluating Spatial Frame of Reference Under Ambiguities}, author = {Zheyuan Zhang and Fengyuan Hu and Jayjun Lee and Freda Shi and Parisa Kordjamshidi and Joyce Chai and Ziqiao Ma}, year = {2025}, url = {https://arxiv.org/abs/2410.17385}, note = {Source identifier: 2410.17385} }