中文

面向端到端自动语码转换语音识别

计算与语言 2018-10-31 v1

摘要

由于数据和重叠音素集的缺乏,例如英语中的“one”和汉语中的“wàn”,混合语言中的语音识别难以适配端到端框架。我们提出了一种基于CTC的端到端自动语音识别模型,用于句内英语-普通话语码转换。该模型通过在单语数据集上联合训练,并使用混合语言语料库进行微调来训练。在解码过程中,我们应用束搜索并结合CTC预测与语言模型分数。所提出的方法能有效利用单语语料库并检测语言转换,将CER降低了5%。

关键词

引用

@article{arxiv.1810.12620,
  title  = {Towards End-to-end Automatic Code-Switching Speech Recognition},
  author = {Genta Indra Winata and Andrea Madotto and Chien-Sheng Wu and Pascale Fung},
  journal= {arXiv preprint arXiv:1810.12620},
  year   = {2018}
}

备注

Submitted to ICASSP 2019