TY - RPRT TI - VisionSelector: End-to-End Learnable Visual Token Compression for Efficient Multimodal LLMs AU - Jiaying Zhu AU - Yurui Zhu AU - Xin Lu AU - Wenrui Yan AU - Dong Li AU - Kunlin Liu AU - Xueyang Fu AU - Zheng-Jun Zha PY - 2026 UR - https://arxiv.org/abs/2510.16598 ID - 2510.16598 ER -