中文

某些前置词和从属连词附着问题的性质

cmp-lg 2009-09-25 v1 计算与语言

摘要

确定前置词和从属连词的附着是自然语言解析中的关键问题。本文提出了一种可训练的方法,通过转换序列和错误驱动学习来实现这些附着。我们的做法覆盖面广,处理的约为以往基于语料库的技术处理的三倍的附着案例。此外,我们的方法基于一种简化的语法模型,更符合当前主流语言处理系统的实践。本文概述了语法和算法细节,并报告了从 Penn Treebank 派生的数据集上的实验结果。我们获得了一般情况下 75.4% 的附着准确率,这是首个报告的基于语料库的结果。对于以往使用语料库方法研究的受限情况,我们的方法准确率与当前工作相当(83.1%)。

关键词

引用

@article{arxiv.cmp-lg/9808009,
  title  = {How to define a context-free backbone for DGs: Implementing a DG in the LFG formalism},
  author = {Norbert Broeker},
  journal= {arXiv preprint arXiv:cmp-lg/9808009},
  year   = {2009}
}

备注

10 pages, LaTeX2e