@misc{indiciae1c890f6ae8ab, title = {Can Linguistic Knowledge Improve Multimodal Alignment in Vision-Language Pretraining?}, author = {Fei Wang and Liang Ding and Jun Rao and Ye Liu and Li Shen and Changxing Ding}, year = {2023}, url = {https://arxiv.org/abs/2308.12898}, note = {Source identifier: 2308.12898} }