端到端语音识别:法语综述
计算与语言
2019-10-24 v2 音频与语音处理
摘要
近来,基于序列到序列网络或 CTC 目标函数的端到端 ASR(自动语音识别)引起了社区的极大兴趣,相较于使用稳健但复杂流程的传统系统取得了具竞争力的结果。端到端系统的主要特性之一,除了能够摆脱词典或语言模型等额外语言资源,还在于能够对字符、子词或直接对词等声学单元建模;从而开启了依据目标语言以不同表示或知识水平直接转录语音的能力。本文针对法语提出了现有端到端 ASR 方法的综述。我们将结果与常规最先进 ASR 系统进行比较,并探讨哪些单元更适合对法语建模。
引用
@article{arxiv.1910.08502,
title = {End-to-End Speech Recognition: A review for the French Language},
author = {Florian Boyer and Jean-Luc Rouas},
journal= {arXiv preprint arXiv:1910.08502},
year = {2019}
}
备注
10 pages, 2 column-style