TY - RPRT TI - Refined Vision-Language Modeling for Fine-grained Multi-modal Pre-training AU - Lisai Zhang AU - Qingcai Chen AU - Zhijian Chen AU - Yunpeng Han AU - Zhonghua Li AU - Zhao Cao PY - 2023 UR - https://arxiv.org/abs/2303.05313 ID - 2303.05313 ER -