TY - RPRT TI - LLM4SCREENLIT: Recommendations on Assessing the Performance of Large Language Models for Screening Literature in Systematic Reviews AU - Lech Madeyski AU - Barbara Kitchenham AU - Martin Shepperd PY - 2026 DO - 10.1016/j.infsof.2026.108204 UR - https://arxiv.org/abs/2511.12635 ID - 2511.12635 ER -