语气边界、语音修复与话语标记:建模口语对话
cmp-lg
2008-02-03 v1 计算与语言
摘要
要理解说话者的对话轮次,需要将其分割为语气短语,清理可能出现的语音修复,并识别话语标记。本文认为,这些问题必须一起解决,并且必须在处理链的早期解决。我们提出了统计语言模型以解决这些问题,执行词性标注,并可作为语音识别器的语言模型。我们发现,通过考虑这些任务之间的相互作用,可提高每个任务的性能,包括词性标注和困惑度。
引用
@article{arxiv.cmp-lg/9704008,
title = {Intonational Boundaries, Speech Repairs and Discourse Markers: Modeling Spoken Dialog},
author = {Peter A. Heeman and James F. Allen},
journal= {arXiv preprint arXiv:cmp-lg/9704008},
year = {2008}
}
备注
8 pages, 3 postscript figures