TY - RPRT TI - MHA2MLA-VLM: Enabling DeepSeek's Economical Multi-Head Latent Attention across Vision-Language Models AU - Xiaoran Fan AU - Zhichao Sun AU - Tao Ji AU - Lixing Shen AU - Tao Gui PY - 2026 UR - https://arxiv.org/abs/2601.11464 ID - 2601.11464 ER -