@misc{indiciae00a5796b83fb, title = {ImageBERT: Cross-modal Pre-training with Large-scale Weak-supervised Image-Text Data}, author = {Di Qi and Lin Su and Jia Song and Edward Cui and Taroon Bharti and Arun Sacheti}, year = {2020}, url = {https://arxiv.org/abs/2001.07966}, note = {Source identifier: 2001.07966} }