@misc{indiciae63eac17686f5, title = {M3-JEPA: Multimodal Alignment via Multi-gate MoE based on the Joint-Embedding Predictive Architecture}, author = {Hongyang Lei and Xiaolong Cheng and Qi Qin and Dan Wang and Kun Fan and Huazhen Huang and Qingqing Gu and Yetao Wu and Zhonglin Jiang and Yong Chen and Luo Ji}, year = {2025}, url = {https://arxiv.org/abs/2409.05929}, note = {Source identifier: 2409.05929} }