@misc{indiciae0c2a655cc715, title = {Assessing and Advancing Benchmarks for Evaluating Large Language Models in Software Engineering Tasks}, author = {Xing Hu and Feifei Niu and Junkai Chen and Xin Zhou and Junwei Zhang and Junda He and Xin Xia and David Lo}, year = {2025}, url = {https://arxiv.org/abs/2505.08903}, note = {Source identifier: 2505.08903} }