TY - RPRT TI - COPA: Efficient Vision-Language Pre-training Through Collaborative Object- and Patch-Text Alignment AU - Chaoya Jiang AU - Haiyang Xu AU - Wei Ye AU - Qinghao Ye AU - Chenliang Li AU - Ming Yan AU - Bin Bi AU - Shikun Zhang AU - Ji Zhang AU - Fei Huang PY - 2024 UR - https://arxiv.org/abs/2308.03475 ID - 2308.03475 ER -