@misc{indiciae23a301d3c736, title = {OmniVL:One Foundation Model for Image-Language and Video-Language Tasks}, author = {Junke Wang and Dongdong Chen and Zuxuan Wu and Chong Luo and Luowei Zhou and Yucheng Zhao and Yujia Xie and Ce Liu and Yu-Gang Jiang and Lu Yuan}, year = {2022}, url = {https://arxiv.org/abs/2209.07526}, note = {Source identifier: 2209.07526} }