TY - RPRT TI - Judging the Judges: Can Large Vision-Language Models Fairly Evaluate Chart Comprehension and Reasoning? AU - Md Tahmid Rahman Laskar AU - Mohammed Saidul Islam AU - Ridwan Mahbub AU - Ahmed Masry AU - Mizanur Rahman AU - Amran Bhuiyan AU - Mir Tafseer Nayeem AU - Shafiq Joty AU - Enamul Hoque AU - Jimmy Huang PY - 2025 UR - https://arxiv.org/abs/2505.08468 ID - 2505.08468 ER -