@misc{indiciae90242f7dd814, title = {Scaling Up Vision-Language Pre-training for Image Captioning}, author = {Xiaowei Hu and Zhe Gan and Jianfeng Wang and Zhengyuan Yang and Zicheng Liu and Yumao Lu and Lijuan Wang}, year = {2022}, url = {https://arxiv.org/abs/2111.12233}, note = {Source identifier: 2111.12233} }