@misc{indiciae87d28b005827, title = {ToolBeHonest: A Multi-level Hallucination Diagnostic Benchmark for Tool-Augmented Large Language Models}, author = {Yuxiang Zhang and Jing Chen and Junjie Wang and Yaxin Liu and Cheng Yang and Chufan Shi and Xinyu Zhu and Zihao Lin and Hanwen Wan and Yujiu Yang and Tetsuya Sakai and Tian Feng and Hayato Yamana}, year = {2024}, url = {https://arxiv.org/abs/2406.20015}, note = {Source identifier: 2406.20015} }