@misc{indiciae91f768fdf988, title = {Unsupervised Vision-and-Language Pre-training Without Parallel Images and Captions}, author = {Liunian Harold Li and Haoxuan You and Zhecan Wang and Alireza Zareian and Shih-Fu Chang and Kai-Wei Chang}, year = {2021}, url = {https://arxiv.org/abs/2010.12831}, note = {Source identifier: 2010.12831} }