@misc{indiciae65cce0c298a3, title = {Flash-VL 2B: Optimizing Vision-Language Model Performance for Ultra-Low Latency and High Throughput}, author = {Bo Zhang and Shuo Li and Runhe Tian and Yang Yang and Jixin Tang and Jinhao Zhou and Lin Ma}, year = {2025}, url = {https://arxiv.org/abs/2505.09498}, note = {Source identifier: 2505.09498} }