TY - RPRT TI - ST$^3$: Accelerating Multimodal Large Language Model by Spatial-Temporal Visual Token Trimming AU - Jiedong Zhuang AU - Lu Lu AU - Ming Dai AU - Rui Hu AU - Jian Chen AU - Qiang Liu AU - Haoji Hu PY - 2024 UR - https://arxiv.org/abs/2412.20105 ID - 2412.20105 ER -