中文

统计解析的三个生成式词汇化模型

cmp-lg 2008-02-03 v1 计算与语言

摘要

在本文中,我们首先提出一种新的统计解析模型,即词汇化上下文无关文法的生成式模型。然后我们将模型扩展以包含对次范畴化和wh-移动的概率处理。华尔街日报文本上的结果表明,该解析器的成分精确率/召回率为88.1%/87.5%,相比Collins 96平均提升2.3%。

关键词

引用

@article{arxiv.cmp-lg/9706022,
  title  = {Three Generative, Lexicalised Models for Statistical Parsing},
  author = {Michael Collins},
  journal= {arXiv preprint arXiv:cmp-lg/9706022},
  year   = {2008}
}

备注

8 pages, to appear in Proceedings of ACL/EACL 97.