TY - RPRT TI - MLB: A Scenario-Driven Benchmark for Evaluating Large Language Models in Clinical Applications AU - Qing He AU - Dongsheng Bi AU - Jianrong Lu AU - Minghui Yang AU - Zixiao Chen AU - Jiacheng Lu AU - Jing Chen AU - Nannan Du AU - Xiao Cu AU - Sijing Wu AU - Peng Xiang AU - Yinyin Hu AU - Yi Guo AU - Chunpu Li AU - Shaoyang Li AU - Zhuo Dong AU - Ming Jiang AU - Shuai Guo AU - Liyun Feng AU - Jin Peng AU - Jian Wang AU - Jinjie Gu AU - Junwei Liu PY - 2026 UR - https://arxiv.org/abs/2601.06193 ID - 2601.06193 ER -