@misc{indiciaec6390b362a2e, title = {VeCLIP: Improving CLIP Training via Visual-enriched Captions}, author = {Zhengfeng Lai and Haotian Zhang and Bowen Zhang and Wentao Wu and Haoping Bai and Aleksei Timofeev and Xianzhi Du and Zhe Gan and Jiulong Shan and Chen-Nee Chuah and Yinfei Yang and Meng Cao}, year = {2024}, url = {https://arxiv.org/abs/2310.07699}, note = {Source identifier: 2310.07699} }