@misc{indiciae4cab501e3588, title = {Recurrence-Enhanced Vision-and-Language Transformers for Robust Multimodal Document Retrieval}, author = {Davide Caffagni and Sara Sarto and Marcella Cornia and Lorenzo Baraldi and Rita Cucchiara}, year = {2025}, url = {https://arxiv.org/abs/2503.01980}, note = {Source identifier: 2503.01980} }