TY - RPRT TI - MAMO: Masked Multimodal Modeling for Fine-Grained Vision-Language Representation Learning AU - Zijia Zhao AU - Longteng Guo AU - Xingjian He AU - Shuai Shao AU - Zehuan Yuan AU - Jing Liu PY - 2023 DO - 10.1145/3539618.3591721 UR - https://arxiv.org/abs/2210.04183 ID - 2210.04183 ER -