基于加权有限自动机的语音识别组合方法
cmp-lg
2008-02-03 v1 计算与语言
摘要
我们提出了一种基于加权有限自动机和加权有限状态转换器的通用框架,用于描述和实现语音识别器。该框架允许我们统一表示语音识别中所使用的数据源和数据结构,包括上下文相关单元、拼写词典、语言模型和词典。此外,可以使用通用且高效的算法来组合实际识别器中的数据源,并优化其应用。在特别是,单个组合算法用于组合语言模型和词典等提前组合的数据源,也用于在识别期间动态组合声学观测和数据源。
引用
@article{arxiv.cmp-lg/9603001,
title = {Speech Recognition by Composition of Weighted Finite Automata},
author = {Fernando C. N. Pereira and Michael D. Riley},
journal= {arXiv preprint arXiv:cmp-lg/9603001},
year = {2008}
}
备注
24 pages, uses psfig.sty