@misc{indiciae17aae7bffdf6, title = {DataPrep-Bench: Benchmarking LLMs as Training Data Preparators}, author = {Hao Liang and Qifeng Cai and Yibo Lin and Jianzhuo Du and Qifeng Xia and Sizhe Qiu and Linzhuang Sun and Meiyi Qiang and Zhaoyang Han and Xiaochen Ma and Bohan Zeng and Ruichuan An and Conghui He and Wentao Zhang}, year = {2026}, url = {https://arxiv.org/abs/2607.20465}, note = {Source identifier: 2607.20465} }