TY - RPRT TI - TextHawk2: A Large Vision-Language Model Excels in Bilingual OCR and Grounding with 16x Fewer Tokens AU - Ya-Qi Yu AU - Minghui Liao AU - Jiwen Zhang AU - Jihao Wu PY - 2024 UR - https://arxiv.org/abs/2410.05261 ID - 2410.05261 ER -