TY - RPRT TI - Likelihood-based Mitigation of Evaluation Bias in Large Language Models AU - Masanari Oi AU - Masahiro Kaneko AU - Ryuto Koike AU - Mengsay Loem AU - Naoaki Okazaki PY - 2025 UR - https://arxiv.org/abs/2402.15987 ID - 2402.15987 ER -