@misc{indiciaefb33b33bc961, title = {Automatically Benchmarking LLM Code Agents through Agent-Driven Annotation and Evaluation}, author = {Lingyue Fu and Bolun Zhang and Hao Guan and Yaoming Zhu and Lin Qiu and Weiwen Liu and Xuezhi Cao and Xunliang Cai and Weinan Zhang and Yong Yu}, year = {2026}, doi = {10.65109/hjfb4234}, url = {https://arxiv.org/abs/2510.24358}, note = {Source identifier: 2510.24358} }