@misc{indiciaea7efacd556ac, title = {XGPT: Cross-modal Generative Pre-Training for Image Captioning}, author = {Qiaolin Xia and Haoyang Huang and Nan Duan and Dongdong Zhang and Lei Ji and Zhifang Sui and Edward Cui and Taroon Bharti and Xin Liu and Ming Zhou}, year = {2020}, url = {https://arxiv.org/abs/2003.01473}, note = {Source identifier: 2003.01473} }