TY - RPRT TI - VISTA-Bench: Do Vision-Language Models Really Understand Visualized Text as Well as Pure Text? AU - Qing'an Liu AU - Juntong Feng AU - Yuhao Wang AU - Xinzhe Han AU - Yujie Cheng AU - Yue Zhu AU - Haiwen Diao AU - Yunzhi Zhuge AU - Huchuan Lu PY - 2026 UR - https://arxiv.org/abs/2602.04802 ID - 2602.04802 ER -