TY - RPRT TI - ROSITA: Enhancing Vision-and-Language Semantic Alignments via Cross- and Intra-modal Knowledge Integration AU - Yuhao Cui AU - Zhou Yu AU - Chunqi Wang AU - Zhongzhou Zhao AU - Ji Zhang AU - Meng Wang AU - Jun Yu PY - 2021 UR - https://arxiv.org/abs/2108.07073 ID - 2108.07073 ER -