@misc{indiciaef00f40fbf606, title = {VEN-VL: A Visual Ensemble MoE Framework for Effective and Efficient Multi-Modal Understanding}, author = {Yinghao Wu and Zhuoyan Luo and Yiyao Yu and Zhaojian Yu and Yujiu Yang and Xiao-Ping Zhang}, year = {2026}, url = {https://arxiv.org/abs/2605.25952}, note = {Source identifier: 2605.25952} }