TY - RPRT TI - Benchmarking Multi-Step Legal Reasoning and Analyzing Chain-of-Thought Effects in Large Language Models AU - Wenhan Yu AU - Xinbo Lin AU - Lanxin Ni AU - Jinhua Cheng AU - Lei Sha PY - 2025 UR - https://arxiv.org/abs/2511.07979 ID - 2511.07979 ER -