@misc{indiciae9296f16b5951, title = {Vision-Language Intelligence: Tasks, Representation Learning, and Large Models}, author = {Feng Li and Hao Zhang and Yi-Fan Zhang and Shilong Liu and Jian Guo and Lionel M. Ni and PengChuan Zhang and Lei Zhang}, year = {2022}, url = {https://arxiv.org/abs/2203.01922}, note = {Source identifier: 2203.01922} }