@misc{indiciae2828cfeb93b7, title = {Understanding Chinese Video and Language via Contrastive Multimodal Pre-Training}, author = {Chenyi Lei and Shixian Luo and Yong Liu and Wanggui He and Jiamang Wang and Guoxin Wang and Haihong Tang and Chunyan Miao and Houqiang Li}, year = {2021}, url = {https://arxiv.org/abs/2104.09411}, note = {Source identifier: 2104.09411} }