@misc{indiciae79f340ae1a5b, title = {VoCo-LLaMA: Towards Vision Compression with Large Language Models}, author = {Xubing Ye and Yukang Gan and Xiaoke Huang and Yixiao Ge and Yansong Tang}, year = {2025}, url = {https://arxiv.org/abs/2406.12275}, note = {Source identifier: 2406.12275} }