某些前置词和从属连词附着问题的性质
cmp-lg
2009-09-25 v1 计算与语言
摘要
确定前置词和从属连词的附着是自然语言解析中的关键问题。本文提出了一种可训练的方法,通过转换序列和错误驱动学习来实现这些附着。我们的做法覆盖面广,处理的约为以往基于语料库的技术处理的三倍的附着案例。此外,我们的方法基于一种简化的语法模型,更符合当前主流语言处理系统的实践。本文概述了语法和算法细节,并报告了从 Penn Treebank 派生的数据集上的实验结果。我们获得了一般情况下 75.4% 的附着准确率,这是首个报告的基于语料库的结果。对于以往使用语料库方法研究的受限情况,我们的方法准确率与当前工作相当(83.1%)。
关键词
引用
@article{arxiv.cmp-lg/9808009,
title = {How to define a context-free backbone for DGs: Implementing a DG in the LFG formalism},
author = {Norbert Broeker},
journal= {arXiv preprint arXiv:cmp-lg/9808009},
year = {2009}
}
备注
10 pages, LaTeX2e