@misc{indiciae905a85c76b26, title = {MagicVL-2B: Empowering Vision-Language Models on Mobile Devices with Lightweight Visual Encoders via Curriculum Learning}, author = {Yi Liu and Xiao Xu and Zeyu Xu and Meng Zhang and Yibo Li and Haoyu Chen and Junkang Zhang and Qiang Wang and Jifa Sun and Siling Lin and Shengxun Cheng and Lingshu Zhang and Kang Wang}, year = {2025}, url = {https://arxiv.org/abs/2508.01540}, note = {Source identifier: 2508.01540} }