TY - RPRT TI - Efficient Multi-modal Large Language Models via Visual Token Grouping AU - Minbin Huang AU - Runhui Huang AU - Han Shi AU - Yimeng Chen AU - Chuanyang Zheng AU - Xiangguo Sun AU - Xin Jiang AU - Zhenguo Li AU - Hong Cheng PY - 2024 UR - https://arxiv.org/abs/2411.17773 ID - 2411.17773 ER -