TY - RPRT TI - Semantics-enhanced Cross-modal Masked Image Modeling for Vision-Language Pre-training AU - Haowei Liu AU - Yaya Shi AU - Haiyang Xu AU - Chunfeng Yuan AU - Qinghao Ye AU - Chenliang Li AU - Ming Yan AU - Ji Zhang AU - Fei Huang AU - Bing Li AU - Weiming Hu PY - 2024 UR - https://arxiv.org/abs/2403.00249 ID - 2403.00249 ER -