TY - RPRT TI - Training Vision-Language Transformers from Captions AU - Liangke Gui AU - Yingshan Chang AU - Qiuyuan Huang AU - Subhojit Som AU - Alex Hauptmann AU - Jianfeng Gao AU - Yonatan Bisk PY - 2023 UR - https://arxiv.org/abs/2205.09256 ID - 2205.09256 ER -