TY - RPRT TI - Legal$Δ$: Enhancing Legal Reasoning in LLMs via Reinforcement Learning with Chain-of-Thought Guided Information Gain AU - Xin Dai AU - Buqiang Xu AU - Zhenghao Liu AU - Yukun Yan AU - Huiyuan Xie AU - Xiaoyuan Yi AU - Shuo Wang AU - Ge Yu PY - 2026 UR - https://arxiv.org/abs/2508.12281 ID - 2508.12281 ER -