@misc{indiciaea243c87fe0bc, title = {From Prefix Cache to Fusion RAG Cache: Accelerating LLM Inference in Retrieval-Augmented Generation}, author = {Jiahao Wang and Weiyu Xie and Mingxing Zhang and Boxing Zhang and Jianwei Dong and Yuening Zhu and Chen Lin and Jinqi Tang and Yaochen Han and Zhiyuan Ai and Xianglin Chen and Yongwei Wu and Congfeng Jiang}, year = {2026}, doi = {10.1145/3786655}, url = {https://arxiv.org/abs/2601.12904}, note = {Source identifier: 2601.12904} }