@misc{indiciae47a487a2df64, title = {COTS: Collaborative Two-Stream Vision-Language Pre-Training Model for Cross-Modal Retrieval}, author = {Haoyu Lu and Nanyi Fei and Yuqi Huo and Yizhao Gao and Zhiwu Lu and Ji-Rong Wen}, year = {2022}, url = {https://arxiv.org/abs/2204.07441}, note = {Source identifier: 2204.07441} }