@misc{indiciae33066aa6c2ad, title = {SemVLP: Vision-Language Pre-training by Aligning Semantics at Multiple Levels}, author = {Chenliang Li and Ming Yan and Haiyang Xu and Fuli Luo and Wei Wang and Bin Bi and Songfang Huang}, year = {2021}, url = {https://arxiv.org/abs/2103.07829}, note = {Source identifier: 2103.07829} }