TY - RPRT TI - Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond AU - Jinze Bai AU - Shuai Bai AU - Shusheng Yang AU - Shijie Wang AU - Sinan Tan AU - Peng Wang AU - Junyang Lin AU - Chang Zhou AU - Jingren Zhou PY - 2023 UR - https://arxiv.org/abs/2308.12966 ID - 2308.12966 ER -