TY - RPRT TI - Masked Vision and Language Modeling for Multi-modal Representation Learning AU - Gukyeong Kwon AU - Zhaowei Cai AU - Avinash Ravichandran AU - Erhan Bas AU - Rahul Bhotika AU - Stefano Soatto PY - 2023 UR - https://arxiv.org/abs/2208.02131 ID - 2208.02131 ER -