@misc{indiciae7136c0ac3984, title = {Efficient Expert Pruning for Sparse Mixture-of-Experts Language Models: Enhancing Performance and Reducing Inference Costs}, author = {Enshu Liu and Junyi Zhu and Zinan Lin and Xuefei Ning and Matthew B. Blaschko and Shengen Yan and Guohao Dai and Huazhong Yang and Yu Wang}, year = {2024}, url = {https://arxiv.org/abs/2407.00945}, note = {Source identifier: 2407.00945} }