TY - RPRT TI - Benchmarking Reasoning Robustness in Large Language Models AU - Tong Yu AU - Yongcheng Jing AU - Xikun Zhang AU - Wentao Jiang AU - Wenjie Wu AU - Yingjie Wang AU - Wenbin Hu AU - Bo Du AU - Dacheng Tao PY - 2025 UR - https://arxiv.org/abs/2503.04550 ID - 2503.04550 ER -