@misc{indiciae8acc526a221d, title = {Mustafar: Promoting Unstructured Sparsity for KV Cache Pruning in LLM Inference}, author = {Donghyeon Joo and Helya Hosseini and Ramyad Hadidi and Bahar Asgari}, year = {2025}, url = {https://arxiv.org/abs/2505.22913}, note = {Source identifier: 2505.22913} }