TY - RPRT TI - Spatially Grounded Explanations in Vision Language Models for Document Visual Question Answering AU - Maximiliano Hormazábal Lagos AU - Héctor Cerezo-Costas AU - Dimosthenis Karatzas PY - 2025 UR - https://arxiv.org/abs/2507.12490 ID - 2507.12490 ER -