@misc{indiciae73a7060a7335, title = {Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models}, author = {Yanwei Li and Yuechen Zhang and Chengyao Wang and Zhisheng Zhong and Yixin Chen and Ruihang Chu and Shaoteng Liu and Jiaya Jia}, year = {2024}, url = {https://arxiv.org/abs/2403.18814}, note = {Source identifier: 2403.18814} }