@misc{indiciae75163b72f256, title = {Minions: Accelerating Large Language Model Inference with Aggregated Speculative Execution}, author = {Siqi Wang and Hailong Yang and Xuezhu Wang and Tongxuan Liu and Pengbo Wang and Xuning Liang and Kejie Ma and Tianyu Feng and Xin You and Yongjun Bao and Yi Liu and Zhongzhi Luan and Depei Qian}, year = {2024}, url = {https://arxiv.org/abs/2402.15678}, note = {Source identifier: 2402.15678} }