TY - RPRT TI - JudgeBoard: Benchmarking and Enhancing Small Language Models for Reasoning Evaluation AU - Zhenyu Bi AU - Gaurav Srivastava AU - Yang Li AU - Meng Lu AU - Swastik Roy AU - Morteza Ziyadi AU - Xuan Wang PY - 2025 UR - https://arxiv.org/abs/2511.15958 ID - 2511.15958 ER -