TY - RPRT TI - NewtonBench: Benchmarking Generalizable Scientific Law Discovery in LLM Agents AU - Tianshi Zheng AU - Kelvin Kiu-Wai Tam AU - Newt Hue-Nam K. Nguyen AU - Baixuan Xu AU - Zhaowei Wang AU - Jiayang Cheng AU - Hong Ting Tsang AU - Weiqi Wang AU - Jiaxin Bai AU - Tianqing Fang AU - Yangqiu Song AU - Ginny Y. Wong AU - Simon See PY - 2026 UR - https://arxiv.org/abs/2510.07172 ID - 2510.07172 ER -