TY - RPRT TI - Evaluating Test-Time Scaling LLMs for Legal Reasoning: OpenAI o1, DeepSeek-R1, and Beyond AU - Yinghao Hu AU - Yaoyao Yu AU - Leilei Gan AU - Bin Wei AU - Kun Kuang AU - Fei Wu PY - 2025 DO - 10.18653/v1/2025.findings-emnlp.742 UR - https://arxiv.org/abs/2503.16040 ID - 2503.16040 ER -