中文

用于税法蕴含与问答中法定推理的数据集

计算与语言 2020-08-13 v3

摘要

立法可视为以自然语言表述的规定性规则集合。我们将立法对案件事实的适用称为法定推理,其中事实同样以自然语言表述。计算性法定推理与机器阅读中大多数现有工作不同,在于决定案件所需的大量信息仅被精确声明一次(一部法律),而机器阅读中所需信息往往通过分布语言统计习得。为探究自然语言理解方法在法定推理上的表现,我们引入一个数据集及一个法律领域文本语料库。无论是否对法律领域微调,机器阅读模型直接应用于我们的题目时表现出较低的开箱性能。我们将其与一个手工构建的、旨在完全解决该任务的基于 Prolog 的系统对比。这些实验支撑了关于法定推理未来挑战的讨论,我们认为这是一个有趣的现实任务,可推动能够利用以自然语言指定的规定性规则的模型的发展。

关键词

引用

@article{arxiv.2005.05257,
  title  = {A Dataset for Statutory Reasoning in Tax Law Entailment and Question Answering},
  author = {Nils Holzenberger and Andrew Blair-Stanek and Benjamin Van Durme},
  journal= {arXiv preprint arXiv:2005.05257},
  year   = {2020}
}