中文

大语言模型在立法内容分析中的应用:波兰议会数据集

计算与语言 2025-03-18 v1

摘要

大语言模型(LLM)是处理自然语言的最佳方法之一,部分原因在于其多功能性。与此同时,领域特定的 LLM 在实际应用中更为实用。本工作引入了一个由官方立法机构网站获取数据而创建的自然语言数据集。该研究聚焦于制定三个自然语言处理任务,以评估 LLM 在波兰法律体系背景下进行立法内容分析的有效性。关键发现强调了 LLM 在自动化和增强立法内容分析方面的潜力,同时强调了理解法律语境等特定挑战。该研究推动了 NLP 在法律领域的发展,特别是在波兰语方面。研究表明,即使是可以普遍获取的数据也可以实际用于立法内容分析。

关键词

引用

@article{arxiv.2503.12100,
  title  = {Large Language Models in Legislative Content Analysis: A Dataset from the Polish Parliament},
  author = {Arkadiusz Bryłkowski and Jakub Klikowski},
  journal= {arXiv preprint arXiv:2503.12100},
  year   = {2025}
}

备注

15 pages, 4 figures