TY - RPRT TI - Activating Visual Context and Commonsense Reasoning through Masked Prediction in VLMs AU - Jiaao Yu AU - Shenwei Li AU - Mingjie Han AU - Yifei Yin AU - Wenzheng Song AU - Chenghao Jia AU - Man Lan PY - 2025 UR - https://arxiv.org/abs/2510.21807 ID - 2510.21807 ER -