@misc{indiciae081d8e05bb9a, title = {MoEQuant: Enhancing Quantization for Mixture-of-Experts Large Language Models via Expert-Balanced Sampling and Affinity Guidance}, author = {Xing Hu and Zhixuan Chen and Dawei Yang and Zukang Xu and Chen Xu and Zhihang Yuan and Sifan Zhou and Jiangyong Yu}, year = {2025}, url = {https://arxiv.org/abs/2505.03804}, note = {Source identifier: 2505.03804} }