TY - RPRT TI - TAP-VL: Text Layout-Aware Pre-training for Enriched Vision-Language Models AU - Jonathan Fhima AU - Elad Ben Avraham AU - Oren Nuriel AU - Yair Kittenplon AU - Roy Ganz AU - Aviad Aberdam AU - Ron Litman PY - 2024 UR - https://arxiv.org/abs/2411.04642 ID - 2411.04642 ER -