@misc{indiciaeed3512f027fb, title = {LMDeploy Accelerates Mixed-Precision LLM Inference with TurboMind}, author = {Li Zhang and Youhe Jiang and Guoliang He and Xin Chen and Han Lv and Qian Yao and Ningsheng Ma and Fangcheng Fu and Kai Chen}, year = {2026}, url = {https://arxiv.org/abs/2508.15601}, note = {Source identifier: 2508.15601} }