TY - RPRT TI - Focus-then-Context: Subject-Centric Progressive Visual Token Reduction for Vision-Language Models AU - Yulin Zhao AU - Zheng Zhang PY - 2026 UR - https://arxiv.org/abs/2605.20950 ID - 2605.20950 ER -