@misc{indiciae85d9b46d6faf, title = {QuickSilver -- Speeding up LLM Inference through Dynamic Token Halting, KV Skipping, Contextual Token Fusion, and Adaptive Matryoshka Quantization}, author = {Danush Khanna and Aditya Kumar Guru and Srivarshinee Sridhar and Zidan Ahmed and Rubhav Bahirwani and Meetu Malhotra and Vinija Jain and Aman Chadha and Amitava Das and Kripabandhu Ghosh}, year = {2025}, url = {https://arxiv.org/abs/2506.22396}, note = {Source identifier: 2506.22396} }