TY - RPRT TI - Q Cache: Visual Attention is Valuable in Less than Half of Decode Layers for Multimodal Large Language Model AU - Jiedong Zhuang AU - Lu Lu AU - Ming Dai AU - Rui Hu AU - Jian Chen AU - Qiang Liu AU - Haoji Hu PY - 2026 UR - https://arxiv.org/abs/2602.01901 ID - 2602.01901 ER -