TY - RPRT TI - From Local Details to Global Context: Advancing Vision-Language Models with Attention-Based Selection AU - Lincan Cai AU - Jingxuan Kang AU - Shuang Li AU - Wenxuan Ma AU - Binhui Xie AU - Zhida Qin AU - Jian Liang PY - 2025 UR - https://arxiv.org/abs/2505.13233 ID - 2505.13233 ER -