TY - RPRT TI - Fact or Guesswork? Evaluating Large Language Models' Medical Knowledge with Structured One-Hop Judgments AU - Jiaxi Li AU - Yiwei Wang AU - Kai Zhang AU - Yujun Cai AU - Bryan Hooi AU - Nanyun Peng AU - Kai-Wei Chang AU - Jin Lu PY - 2025 UR - https://arxiv.org/abs/2502.14275 ID - 2502.14275 ER -