@misc{indiciae0426479079b1, title = {Can Pre-trained Vision and Language Models Answer Visual Information-Seeking Questions?}, author = {Yang Chen and Hexiang Hu and Yi Luan and Haitian Sun and Soravit Changpinyo and Alan Ritter and Ming-Wei Chang}, year = {2023}, url = {https://arxiv.org/abs/2302.11713}, note = {Source identifier: 2302.11713} }