TY - RPRT TI - From Prefix Cache to Fusion RAG Cache: Accelerating LLM Inference in Retrieval-Augmented Generation AU - Jiahao Wang AU - Weiyu Xie AU - Mingxing Zhang AU - Boxing Zhang AU - Jianwei Dong AU - Yuening Zhu AU - Chen Lin AU - Jinqi Tang AU - Yaochen Han AU - Zhiyuan Ai AU - Xianglin Chen AU - Yongwei Wu AU - Congfeng Jiang PY - 2026 DO - 10.1145/3786655 UR - https://arxiv.org/abs/2601.12904 ID - 2601.12904 ER -