日语话语中的中心化
cmp-lg
2016-08-31 v1 计算与语言
摘要
本文提出了一种用于解析日语话语中零代词的计算方法,采用对中心化算法的改编。我们能够将语言特定的依赖项分解为中心化算法的一个参数。以前的分析认为,零代词及其共指限定器必须共享如{sc Subject}或{sc NonSubject}等语法功能属性。我们表明,这种属性共享的规定是不必要的。此外,我们提出了{sc topic ambiguity}(话题歧义)的概念,该概念在中心化框架内预测了日语话语中出现的某些歧义。该分析对自然语言系统的语言无关话语模块设计具有启发意义。中心化算法已在包含英文和日语语法的HPSG自然语言系统中实现。
引用
@article{arxiv.cmp-lg/9609004,
title = {A Principled Framework for Constructing Natural Language Interfaces To Temporal Databases},
author = {Ion Androutsopoulos},
journal= {arXiv preprint arXiv:cmp-lg/9609004},
year = {2016}
}
备注
PhD thesis; 405 pages; LaTeX2e, uses the packages/macros: amstex, xspace, avm, examples, dvips, varioref, makeidx, epic, eepic, ecltree; postscript figures included