TY - RPRT TI - REFLEX: Rethinking MoE Inference as Refinement-Aware Compute Allocation in Diffusion Language Models AU - Xiang Xia AU - Cheng Yan AU - Yiming Zhang AU - Jiazheng Liu AU - Hongyu Zhang AU - Wuyang Zhang PY - 2026 UR - https://arxiv.org/abs/2608.01784 ID - 2608.01784 ER -