开发混合NP解析器
cmp-lg
2008-02-03 v2 计算与语言
摘要
我们描述了在浅层语法解析中使用能量函数优化的方法。该方法可以同时使用语言学规则和语料库统计数据,以将语言学和统计方法在NLP框架中的优势组合在一起。规则是用于解决语法歧义的上下文约束,以备选标签形式表达;统计语言模型由语料库中语法标签的n-gram组成。对混合语法消歧器的成功进行了与持留样本语料库的评估。还估计了语言学和统计语言模型对混合模型的贡献。
引用
@article{arxiv.cmp-lg/9704009,
title = {Developing a hybrid NP parser},
author = {Atro Voutilainen and Lluis Padro},
journal= {arXiv preprint arXiv:cmp-lg/9704009},
year = {2008}
}
备注
8 pages, uses aclap.sty, epsf.sty