@misc{indiciaed42f21556777, title = {COSA: Concatenated Sample Pretrained Vision-Language Foundation Model}, author = {Sihan Chen and Xingjian He and Handong Li and Xiaojie Jin and Jiashi Feng and Jing Liu}, year = {2023}, url = {https://arxiv.org/abs/2306.09085}, note = {Source identifier: 2306.09085} }