中文

基于熵阈值的语法专化

cmp-lg 2008-02-03 v1 计算与语言

摘要

解释性泛化用于从原始语法中提取Specialized grammar。通过使用解析树训练语料库,这允许更快的解析并降低错误率,但会以一定程度的覆盖率损失为代价。以前需要手动指定树切割准则(或操作性准则);本文中,这些准则从训练集和Specialized grammar的预期覆盖率中自动推导。通过为解析树中的每个节点分配熵值,并切割熵值足够高的节点来实现。

关键词

引用

@article{arxiv.cmp-lg/9405022,
  title  = {Grammar Specialization through Entropy Thresholds},
  author = {Christer Samuelsson},
  journal= {arXiv preprint arXiv:cmp-lg/9405022},
  year   = {2008}
}

备注

8 pages