TY - RPRT TI - GroundVTS: Visual Token Sampling in Multimodal Large Language Models for Video Temporal Grounding AU - Rong Fan AU - Kaiyan Xiao AU - Minghao Zhu AU - Liuyi Wang AU - Kai Dai AU - Zhao Yang PY - 2026 UR - https://arxiv.org/abs/2604.02093 ID - 2604.02093 ER -