语音识别与语言处理的算法
cmp-lg
2008-02-03 v2 计算与语言
摘要
语音处理需要高效的方法和算法。有限状态传递器(Finite-state transducers)最近被证明既是非常有用的抽象模型,也能导致在该领域中高度有效的时间和空间复杂度的算法。我们展示了这些方法和算法,并以语音识别为例进行说明。除了经典技术外,我们还描述了许多新算法,如最小化、全局和局部即时确定化加权自动机以及传递器的高效组合。这些方法当前已被用于大规模语音识别系统。随后我们展示了相同的形式化和算法如何在文本转换语音应用以及相关语言处理领域,如形态学、语法和局部语法中以高效方式使用。该教程是自包含的,除经典结果外,不需要特定的计算或语言知识。
引用
@article{arxiv.cmp-lg/9608018,
title = {Algorithms for Speech Recognition and Language Processing},
author = {Mehryar Mohri and Michael Riley and Richard Sproat},
journal= {arXiv preprint arXiv:cmp-lg/9608018},
year = {2008}
}
备注
Postscript file tar-compressed and uuencoded, 189 pages