@misc{indiciae62f47735c3e7, title = {ROME: Evaluating Pre-trained Vision-Language Models on Reasoning beyond Visual Common Sense}, author = {Kankan Zhou and Eason Lai and Wei Bin Au Yeong and Kyriakos Mouratidis and Jing Jiang}, year = {2023}, url = {https://arxiv.org/abs/2310.19301}, note = {Source identifier: 2310.19301} }