TY - RPRT TI - RUPBench: Benchmarking Reasoning Under Perturbations for Robustness Evaluation in Large Language Models AU - Yuqing Wang AU - Yun Zhao PY - 2024 UR - https://arxiv.org/abs/2406.11020 ID - 2406.11020 ER -