TY - RPRT TI - Aligning Model Evaluations with Human Preferences: Mitigating Token Count Bias in Language Model Assessments AU - Roland Daynauth AU - Jason Mars PY - 2024 UR - https://arxiv.org/abs/2407.12847 ID - 2407.12847 ER -