TY - RPRT TI - How Well Can Vision Language Models See Image Details? AU - Chenhui Gou AU - Abdulwahab Felemban AU - Faizan Farooq Khan AU - Deyao Zhu AU - Jianfei Cai AU - Hamid Rezatofighi AU - Mohamed Elhoseiny PY - 2024 UR - https://arxiv.org/abs/2408.03940 ID - 2408.03940 ER -