@misc{indiciaeb364e2f6437f, title = {WIDE: Boosting Adaptive LLM Inference via Token-level Dynamic Width Pruning}, author = {Haozhe Hu and Hao Wu and Peiran Yin and Chao Han and Yunpu Ma and Xiaoyu Shen}, year = {2026}, url = {https://arxiv.org/abs/2607.28418}, note = {Source identifier: 2607.28418} }