@misc{indiciaebfa86ff73462, title = {BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models}, author = {Junnan Li and Dongxu Li and Silvio Savarese and Steven Hoi}, year = {2023}, url = {https://arxiv.org/abs/2301.12597}, note = {Source identifier: 2301.12597} }