TY - RPRT TI - Unilaw-R1: A Large Language Model for Legal Reasoning with Reinforcement Learning and Iterative Inference AU - Hua Cai AU - Shuang Zhao AU - Liang Zhang AU - Xuli Shen AU - Qing Xu AU - Weilin Shen AU - Zihao Wen AU - Tianke Ban PY - 2025 UR - https://arxiv.org/abs/2510.10072 ID - 2510.10072 ER -