@misc{indiciae5db04f5d7d8b, title = {Unified Vision-Language Pre-Training for Image Captioning and VQA}, author = {Luowei Zhou and Hamid Palangi and Lei Zhang and Houdong Hu and Jason J. Corso and Jianfeng Gao}, year = {2019}, url = {https://arxiv.org/abs/1909.11059}, note = {Source identifier: 1909.11059} }