语音修正、语调边界与话语标记:建模 spoken dialog 中的说话者陈述
cmp-lg
2007-05-23 v1 计算与语言
摘要
本文提出了一种用于解决语音修正、语调边界和话语标记的统计语言模型。与寻找语音信号的最佳词解释不同,我们重新定义了语音识别问题,以便同时识别词性标记、话语标记、语音修正以及语调短语结束(决定说话单位的重要线索)。将这些额外元素添加到语音识别问题中,实际上允许更好地预测涉及的单词,因为我们能够利用语调短语结束、话语标记和语音修正的预测,以更好地解释下一个单词将是什么。此外,我们可以利用诸如静音信息等声学信息,这类信息倾向于与语音修正和语调短语结束同时出现,而当前语言模型只能将其视为噪声。该语言模型的输出是对说话者陈述的更完整描述,包括为每个单词分配的词性、识别的语调短语结束、识别的话语标记,以及检测和纠正的语音修正。事实上,识别语调短语结束、话语标记以及解决语音修正,使语音识别器能够建模说话者的陈述,而不仅仅是涉及的单词,从而返回更有意义的说话者陈述分析,以供后续处理。
关键词
引用
@article{arxiv.cmp-lg/9712009,
title = {Speech Repairs, Intonational Boundaries and Discourse Markers: Modeling Speakers' Utterances in Spoken Dialog},
author = {Peter A. Heeman},
journal= {arXiv preprint arXiv:cmp-lg/9712009},
year = {2007}
}
备注
280 pages, doctoral dissertation (latex with postscript figures)