Earley 解析的一种变体
cmp-lg
2007-05-23 v1 计算与语言
摘要
Earley 算法是自然语言处理应用中广泛使用的解析方法。我们提出了一种基于"延迟"识别成分的 Earley 解析变体。这使得我们仅在输入字符串中找到了所有子成分的情况下才开始识别一个成分。这在以下几种情况下特别有利:成分的部分分析无法完成的情况,以及一般而言所有右部共享某些后缀的产生式情况(即使对于不同的左部非终结符也是如此)。尽管这两种算法具有相同的渐近时间和空间复杂度,但从实际角度来看,我们的算法改进了原始方法的时间和空间需求,如报告的实验结果所示。
引用
@article{arxiv.cmp-lg/9808017,
title = {A Variant of Earley Parsing},
author = {Mark-Jan Nederhof and Giorgio Satta},
journal= {arXiv preprint arXiv:cmp-lg/9808017},
year = {2007}
}
备注
12 pages, 1 Postscript figure, uses psfig.tex and llncs.sty