中文

欧盟立法中监管语句的计算识别

计算与语言 2025-05-02 v1

摘要

识别立法中的监管语句有助于开发衡量立法监管密度与严格程度的指标。计算方法对于从不断增长的欧盟立法库中扩展识别此类语句具有重要价值,该立法库包含 1952 年至 2023 年间约 180,000 项已发布的法律法案。过去关于提取这些语句的工作在界定何为监管语句的宽松程度上各不相同。在本工作中,我们基于制度语法工具,为我们的目的提供了一个具体的定义。我们开发并比较了两种对比方法,用于在欧盟立法中自动识别此类语句,一种基于依存句法分析,另一种基于 Transformer 机器学习模型。我们发现这两种方法表现相似,准确率分别为 80% 和 84%,K alpha 为 0.58。较高的准确率以及并非极高的吻合度表明,结合两种方法的优势具有潜力。

关键词

引用

@article{arxiv.2505.00479,
  title  = {Computational Identification of Regulatory Statements in EU Legislation},
  author = {Gijs Jan Brandsma and Jens Blom-Hansen and Christiaan Meijer and Kody Moodley},
  journal= {arXiv preprint arXiv:2505.00479},
  year   = {2025}
}

备注

11 pages, 6 figures