@misc{indiciae70616c4440cb, title = {CompactRAG: Reducing LLM Calls and Token Overhead in Multi-Hop Question Answering}, author = {Hao Yang and Zhiyu Yang and Xupeng Zhang and Wei Wei and Yunjie Zhang and Lin Yang}, year = {2026}, url = {https://arxiv.org/abs/2602.05728}, note = {Source identifier: 2602.05728} }