TY - RPRT TI - Fine-grained Visual Textual Alignment for Cross-Modal Retrieval using Transformer Encoders AU - Nicola Messina AU - Giuseppe Amato AU - Andrea Esuli AU - Fabrizio Falchi AU - Claudio Gennaro AU - Stéphane Marchand-Maillet PY - 2021 UR - https://arxiv.org/abs/2008.05231 ID - 2008.05231 ER -