@misc{indiciae7fdb6f5a8d75, title = {SwiftVLM: Efficient Vision-Language Model Inference via Cross-Layer Token Bypass}, author = {Chen Qian and Xinran Yu and Danyang Li and Guoxuan Chi and Zheng Yang and Qiang Ma and Xin Miao}, year = {2026}, url = {https://arxiv.org/abs/2602.03134}, note = {Source identifier: 2602.03134} }