TY - RPRT TI - DocSLM: A Small Vision-Language Model for Long Multimodal Document Understanding AU - Tanveer Hannan AU - Dimitrios Mallios AU - Parth Pathak AU - Faegheh Sardari AU - Thomas Seidl AU - Gedas Bertasius AU - Mohsen Fayyaz AU - Sunando Sengupta PY - 2025 UR - https://arxiv.org/abs/2511.11313 ID - 2511.11313 ER -