TY - RPRT TI - Automated MCQA Benchmarking at Scale: Evaluating Reasoning Traces as Retrieval Sources for Domain Adaptation of Small Language Models AU - Ozan Gokdemir AU - Neil Getty AU - Robert Underwood AU - Sandeep Madireddy AU - Franck Cappello AU - Arvind Ramanathan AU - Ian T. Foster AU - Rick L. Stevens PY - 2025 UR - https://arxiv.org/abs/2509.10744 ID - 2509.10744 ER -