TY - RPRT TI - WIDE: Boosting Adaptive LLM Inference via Token-level Dynamic Width Pruning AU - Haozhe Hu AU - Hao Wu AU - Peiran Yin AU - Chao Han AU - Yunpu Ma AU - Xiaoyu Shen PY - 2026 UR - https://arxiv.org/abs/2607.28418 ID - 2607.28418 ER -