TY - RPRT TI - VITR: Augmenting Vision Transformers with Relation-Focused Learning for Cross-Modal Information Retrieval AU - Yan Gong AU - Georgina Cosma AU - Axel Finke PY - 2023 UR - https://arxiv.org/abs/2302.06350 ID - 2302.06350 ER -