@misc{indiciaeff0cf302e822, title = {Oscar: Object-Semantics Aligned Pre-training for Vision-Language Tasks}, author = {Xiujun Li and Xi Yin and Chunyuan Li and Pengchuan Zhang and Xiaowei Hu and Lei Zhang and Lijuan Wang and Houdong Hu and Li Dong and Furu Wei and Yejin Choi and Jianfeng Gao}, year = {2020}, url = {https://arxiv.org/abs/2004.06165}, note = {Source identifier: 2004.06165} }