@misc{indiciae45650a25d31c, title = {FEM-Bench: A Structured Scientific Reasoning Benchmark for Evaluating Code-Generating LLMs}, author = {Saeed Mohammadzadeh and Erfan Hamdi and Joel Shor and Emma Lejeune}, year = {2026}, url = {https://arxiv.org/abs/2512.20732}, note = {Source identifier: 2512.20732} }