@misc{indiciaebad43d46b1d2, title = {REFLEX: Rethinking MoE Inference as Refinement-Aware Compute Allocation in Diffusion Language Models}, author = {Xiang Xia and Cheng Yan and Yiming Zhang and Jiazheng Liu and Hongyu Zhang and Wuyang Zhang}, year = {2026}, url = {https://arxiv.org/abs/2608.01784}, note = {Source identifier: 2608.01784} }