TY - RPRT TI - Aligning with Human Judgement: The Role of Pairwise Preference in Large Language Model Evaluators AU - Yinhong Liu AU - Han Zhou AU - Zhijiang Guo AU - Ehsan Shareghi AU - Ivan Vulić AU - Anna Korhonen AU - Nigel Collier PY - 2025 UR - https://arxiv.org/abs/2403.16950 ID - 2403.16950 ER -