NESTLE:面向法律语料统计分析的无代码工具
计算与语言
2024-02-07 v2 人工智能
摘要
大规模法律语料的统计分析可提供宝贵的法律洞见。此类分析需要(1)使用文档检索工具选取语料子集,(2)利用信息抽取(IE)系统结构化文本,以及(3)将数据可视化以进行统计分析。每个过程都需要专门工具或编程技能,而目前尚无全面的统一“无代码”工具。在此我们提供 NESTLE,一个用于大规模法律语料统计分析的无代码工具。由大语言模型(LLM)与内部定制端到端 IE 系统驱动,NESTLE 可抽取 IE 系统中未预定义的任意类型信息,开启了无需编写一行代码即可对语料进行无限可定制统计分析的可能性。我们在 15 个韩国判例 IE 任务与来自 LexGLUE 的 3 个法律文本分类任务上验证了系统。综合实验表明,通过使用 4 个人工标注和 192 个 LLM 标注样本训练内部 IE 模块,NESTLE 可达到与 GPT-4 相当的性能。
引用
@article{arxiv.2309.04146,
title = {NESTLE: a No-Code Tool for Statistical Analysis of Legal Corpus},
author = {Kyoungyeon Cho and Seungkum Han and Young Rok Choi and Wonseok Hwang},
journal= {arXiv preprint arXiv:2309.04146},
year = {2024}
}
备注
EACL 2024 System Demonstration Track