TY - RPRT TI - MLR-Bench: Evaluating AI Agents on Open-Ended Machine Learning Research AU - Hui Chen AU - Miao Xiong AU - Yujie Lu AU - Wei Han AU - Ailin Deng AU - Yufei He AU - Jiaying Wu AU - Yibo Li AU - Yue Liu AU - Bryan Hooi PY - 2025 UR - https://arxiv.org/abs/2505.19955 ID - 2505.19955 ER -