TY - RPRT TI - MLIM: Vision-and-Language Model Pre-training with Masked Language and Image Modeling AU - Tarik Arici AU - Mehmet Saygin Seyfioglu AU - Tal Neiman AU - Yi Xu AU - Son Train AU - Trishul Chilimbi AU - Belinda Zeng AU - Ismail Tutar PY - 2021 UR - https://arxiv.org/abs/2109.12178 ID - 2109.12178 ER -