@misc{indiciaec835a40abace, title = {LightVLM: Acceleraing Large Multimodal Models with Pyramid Token Merging and KV Cache Compression}, author = {Lianyu Hu and Fanhua Shang and Wei Feng and Liang Wan}, year = {2025}, url = {https://arxiv.org/abs/2509.00419}, note = {Source identifier: 2509.00419} }