TY - RPRT TI - ML-Bench: Evaluating Large Language Models and Agents for Machine Learning Tasks on Repository-Level Code AU - Xiangru Tang AU - Yuliang Liu AU - Zefan Cai AU - Yanjun Shao AU - Junjie Lu AU - Yichi Zhang AU - Zexuan Deng AU - Helan Hu AU - Kaikai An AU - Ruijun Huang AU - Shuzheng Si AU - Sheng Chen AU - Haozhe Zhao AU - Liang Chen AU - Yan Wang AU - Tianyu Liu AU - Zhiwei Jiang AU - Baobao Chang AU - Yin Fang AU - Yujia Qin AU - Wangchunshu Zhou AU - Yilun Zhao AU - Arman Cohan AU - Mark Gerstein PY - 2024 UR - https://arxiv.org/abs/2311.09835 ID - 2311.09835 ER -