TY - RPRT TI - NEO-BENCH: Evaluating Robustness of Large Language Models with Neologisms AU - Jonathan Zheng AU - Alan Ritter AU - Wei Xu PY - 2024 UR - https://arxiv.org/abs/2402.12261 ID - 2402.12261 ER -