@misc{indiciae312e1a9575af, title = {Enhancing Vision Foundation Models via Multimodal Continual Pre-Training}, author = {Yitong Chen and Lingchen Meng and Wujian Peng and Jun Tao and Chenjie Xu and Zuxuan Wu and Yu-Gang Jiang}, year = {2026}, url = {https://arxiv.org/abs/2503.18931}, note = {Source identifier: 2503.18931} }