中文

LexPro-1.0 技术报告

计算与语言 2025-03-12 v2

摘要

在本报告中,我们介绍了我们的第一代推理模型 LexPro-1.0,这是一个专为高度专业化的中文法律领域设计的大语言模型,提供全面的能力以满足各种现实需求。现有的法律 LLM 面临两个主要挑战。首先,它们的设计和评估主要由计算机科学视角驱动,导致对法律专业知识和逻辑的融入不足,而这对于高精度法律应用(如处理复杂的检察任务)至关重要。其次,由于缺乏来自法律领域的全面训练数据,这些模型往往表现不佳,限制了它们有效应对现实法律场景的能力。为了解决这个问题,我们首先汇编了涵盖中国 31 个省份 20 多种罪名的数百万份法律文件用于模型训练。从这一庞大数据集中,我们进一步筛选高质量数据进行监督微调,以确保增强的相关性和精确度。该模型进一步在没有额外监督的情况下进行了大规模强化学习,重点提升其推理能力和可解释性。为了验证其在复杂法律应用中的有效性,我们还邀请了法律专家进行人工评估。我们基于 DeepSeek-R1-Distilled 版本开发了微调模型,提供三种密集配置:14B、32B 和 70B。

关键词

引用

@article{arxiv.2503.06949,
  title  = {LexPro-1.0 Technical Report},
  author = {Haotian Chen and Yanyu Xu and Boyan Wang and Chaoyue Zhao and Xiaoyu Han and Fang Wang and Lizhen Cui and Yonghui Xu},
  journal= {arXiv preprint arXiv:2503.06949},
  year   = {2025}
}