中文

面向法律领域的自然语言处理:任务、数据集、模型与挑战综述

计算与语言 2025-12-12 v3 人工智能

摘要

自然语言处理(NLP)正在彻底改变专业人士和非专业人士在法律领域的工作方式。NLP在法律领域的巨大潜力,特别是在为各种法律流程开发计算辅助工具方面,多年来一直吸引着研究人员的兴趣。本综述遵循系统综述和元分析的首选报告项目框架,回顾了154项研究,经过人工筛选后最终选定131项。它探讨了与法律领域NLP相关的基础概念,阐述了处理法律文本的独特方面和挑战,例如文档篇幅长、语言复杂以及开放法律数据集有限。我们概述了特定于法律文本的NLP任务,如文档摘要、命名实体识别、问答、论点挖掘、文本分类和判决预测。此外,我们分析了已开发的面向法律的语言模型,以及将通用语言模型适配到法律领域的方法。另外,我们确定了十六个开放的研究挑战,包括人工智能应用中偏见的检测与缓解、对更鲁棒和可解释模型的需求,以及提高可解释性以处理法律语言和推理的复杂性。

关键词

引用

@article{arxiv.2410.21306,
  title  = {Natural Language Processing for the Legal Domain: A Survey of Tasks, Datasets, Models, and Challenges},
  author = {Farid Ariai and Joel Mackenzie and Gianluca Demartini},
  journal= {arXiv preprint arXiv:2410.21306},
  year   = {2025}
}

备注

35 pages