TY - RPRT TI - RoTBench: A Multi-Level Benchmark for Evaluating the Robustness of Large Language Models in Tool Learning AU - Junjie Ye AU - Yilong Wu AU - Songyang Gao AU - Caishuang Huang AU - Sixian Li AU - Guanyu Li AU - Xiaoran Fan AU - Qi Zhang AU - Tao Gui AU - Xuanjing Huang PY - 2024 UR - https://arxiv.org/abs/2401.08326 ID - 2401.08326 ER -