TY - RPRT TI - MoEQuant: Enhancing Quantization for Mixture-of-Experts Large Language Models via Expert-Balanced Sampling and Affinity Guidance AU - Xing Hu AU - Zhixuan Chen AU - Dawei Yang AU - Zukang Xu AU - Chen Xu AU - Zhihang Yuan AU - Sifan Zhou AU - Jiangyong Yu PY - 2025 UR - https://arxiv.org/abs/2505.03804 ID - 2505.03804 ER -