统计解析的三个生成式词汇化模型
cmp-lg
2008-02-03 v1 计算与语言
摘要
在本文中,我们首先提出一种新的统计解析模型,即词汇化上下文无关文法的生成式模型。然后我们将模型扩展以包含对次范畴化和wh-移动的概率处理。华尔街日报文本上的结果表明,该解析器的成分精确率/召回率为88.1%/87.5%,相比Collins 96平均提升2.3%。
引用
@article{arxiv.cmp-lg/9706022,
title = {Three Generative, Lexicalised Models for Statistical Parsing},
author = {Michael Collins},
journal= {arXiv preprint arXiv:cmp-lg/9706022},
year = {2008}
}
备注
8 pages, to appear in Proceedings of ACL/EACL 97.