@misc{indiciae6aed52f4d705, title = {ToMoE: Converting Dense Large Language Models to Mixture-of-Experts through Dynamic Structural Pruning}, author = {Shangqian Gao and Ting Hua and Reza Shirkavand and Chi-Heng Lin and Zheng Tang and Zhengao Li and Longge Yuan and Fangyi Li and Zeyu Zhang and Alireza Ganjdanesh and Lou Qian and Xu Jie and Yen-Chang Hsu}, year = {2026}, url = {https://arxiv.org/abs/2501.15316}, note = {Source identifier: 2501.15316} }