Unilaw-R1: A Large Language Model for Legal Reasoning with Reinforcement Learning and Iterative Inference.
Hua Cai, Shuang Zhao, Liang Zhang, Xuli Shen, Qing Xu, Weilin Shen, Zihao Wen, Tianke Ban
Browse the full EMNLP paper archive.
Hua Cai, Shuang Zhao, Liang Zhang, Xuli Shen, Qing Xu, Weilin Shen, Zihao Wen, Tianke Ban
Browse the full EMNLP paper archive.