TY - RPRT TI - DARE-bench: Evaluating Modeling and Instruction Fidelity of LLMs in Data Science AU - Fan Shu AU - Yite Wang AU - Ruofan Wu AU - Boyi Liu AU - Zhewei Yao AU - Yuxiong He AU - Feng Yan PY - 2026 UR - https://arxiv.org/abs/2602.24288 ID - 2602.24288 ER -