@misc{indiciaec0a8074e07de, title = {Benchmarking Reasoning Robustness in Large Language Models}, author = {Tong Yu and Yongcheng Jing and Xikun Zhang and Wentao Jiang and Wenjie Wu and Yingjie Wang and Wenbin Hu and Bo Du and Dacheng Tao}, year = {2025}, url = {https://arxiv.org/abs/2503.04550}, note = {Source identifier: 2503.04550} }