@misc{indiciaec1753a7b1efc, title = {mPLUG: Effective and Efficient Vision-Language Learning by Cross-modal Skip-connections}, author = {Chenliang Li and Haiyang Xu and Junfeng Tian and Wei Wang and Ming Yan and Bin Bi and Jiabo Ye and Hehong Chen and Guohai Xu and Zheng Cao and Ji Zhang and Songfang Huang and Fei Huang and Jingren Zhou and Luo Si}, year = {2022}, url = {https://arxiv.org/abs/2205.12005}, note = {Source identifier: 2205.12005} }