@misc{indiciaea7f5535ff562, title = {OmniParser V2: Structured-Points-of-Thought for Unified Visual Text Parsing and Its Generality to Multimodal Large Language Models}, author = {Wenwen Yu and Zhibo Yang and Jianqiang Wan and Sibo Song and Jun Tang and Wenqing Cheng and Yuliang Liu and Xiang Bai}, year = {2026}, doi = {10.1109/tpami.2026.3677075}, url = {https://arxiv.org/abs/2502.16161}, note = {Source identifier: 2502.16161} }