@misc{indiciae7be19c10f72e, title = {KV Cache Optimization Strategies for Scalable and Efficient LLM Inference}, author = {Yichun Xu and Navjot K. Khaira and Tejinder Singh}, year = {2026}, url = {https://arxiv.org/abs/2603.20397}, note = {Source identifier: 2603.20397} }