@misc{indiciae9741673645c5, title = {Tail-Optimized Caching for LLM Inference}, author = {Wenxin Zhang and Yueying Li and Ciamac C. Moallemi and Tianyi Peng}, year = {2025}, url = {https://arxiv.org/abs/2510.15152}, note = {Source identifier: 2510.15152} }