@misc{indiciaec642d314a2a0, title = {Spatially Grounded Explanations in Vision Language Models for Document Visual Question Answering}, author = {Maximiliano Hormazábal Lagos and Héctor Cerezo-Costas and Dimosthenis Karatzas}, year = {2025}, url = {https://arxiv.org/abs/2507.12490}, note = {Source identifier: 2507.12490} }