@misc{indiciae036c3db342a3, title = {A Survey on Large Language Model Acceleration based on KV Cache Management}, author = {Haoyang Li and Yiming Li and Anxin Tian and Tianhao Tang and Zhanchao Xu and Xuejia Chen and Nicole Hu and Wei Dong and Qing Li and Lei Chen}, year = {2025}, url = {https://arxiv.org/abs/2412.19442}, note = {Source identifier: 2412.19442} }