@misc{indiciae66b62d117037, title = {CALVO: Improve Serving Efficiency for LLM Inferences with Intense Network Demands}, author = {Weiye Wang and Chen Chen and Junxue Zhang and Zhusheng Wang and Hui Yuan and Zixuan Guan and Xiaolong Zheng and Qizhen Weng and Yin Chen and Minyi Guo}, year = {2026}, url = {https://arxiv.org/abs/2603.21257}, note = {Source identifier: 2603.21257} }