TY - RPRT TI - UBench: Benchmarking Uncertainty in Large Language Models with Multiple Choice Questions AU - Xunzhi Wang AU - Zhuowei Zhang AU - Gaonan Chen AU - Qiongyu Li AU - Bitong Luo AU - Zhixin Han AU - Haotian Wang AU - Zhiyu li AU - Hang Gao AU - Mengting Hu PY - 2025 UR - https://arxiv.org/abs/2406.12784 ID - 2406.12784 ER -