TY - RPRT TI - VCR: A Task for Pixel-Level Complex Reasoning in Vision Language Models via Restoring Occluded Text AU - Tianyu Zhang AU - Suyuchen Wang AU - Lu Li AU - Ge Zhang AU - Perouz Taslakian AU - Sai Rajeswar AU - Jie Fu AU - Bang Liu AU - Yoshua Bengio PY - 2025 UR - https://arxiv.org/abs/2406.06462 ID - 2406.06462 ER -