TY - RPRT TI - PairBench: Are Vision-Language Models Reliable at Comparing What They See? AU - Aarash Feizi AU - Sai Rajeswar AU - Adriana Romero-Soriano AU - Reihaneh Rabbany AU - Valentina Zantedeschi AU - Spandana Gella AU - João Monteiro PY - 2025 UR - https://arxiv.org/abs/2502.15210 ID - 2502.15210 ER -