TY - RPRT TI - Revisit Large-Scale Image-Caption Data in Pre-training Multimodal Foundation Models AU - Zhengfeng Lai AU - Vasileios Saveris AU - Chen Chen AU - Hong-You Chen AU - Haotian Zhang AU - Bowen Zhang AU - Juan Lao Tebar AU - Wenze Hu AU - Zhe Gan AU - Peter Grasch AU - Meng Cao AU - Yinfei Yang PY - 2024 UR - https://arxiv.org/abs/2410.02740 ID - 2410.02740 ER -