@misc{indiciaebcab2ddc9660, title = {EVE: Efficient Vision-Language Pre-training with Masked Prediction and Modality-Aware MoE}, author = {Junyi Chen and Longteng Guo and Jia Sun and Shuai Shao and Zehuan Yuan and Liang Lin and Dongyu Zhang}, year = {2024}, url = {https://arxiv.org/abs/2308.11971}, note = {Source identifier: 2308.11971} }