TY - RPRT TI - Vision language models are blind: Failing to translate detailed visual features into words AU - Pooyan Rahmanzadehgervi AU - Logan Bolton AU - Mohammad Reza Taesiri AU - Anh Totti Nguyen PY - 2025 UR - https://arxiv.org/abs/2407.06581 ID - 2407.06581 ER -