@misc{indiciae11443ee95cff, title = {Expert Streaming: Accelerating Low-Batch MoE Inference via Multi-chiplet Architecture and Dynamic Expert Trajectory Scheduling}, author = {Songchen Ma and Hongyi Li and Weihao Zhang and Yonghao Tan and Pingcheng Dong and Yu Liu and Lan Liu and Yuzhong Jiao and Xuejiao Liu and Luhong Liang and Kwang-Ting Cheng}, year = {2026}, url = {https://arxiv.org/abs/2603.27624}, note = {Source identifier: 2603.27624} }