中文

PronouncUR:一个乌尔都语发音词典生成器

计算与语言 2018-03-06 v2

摘要

最先进的语音识别系统严重依赖三个基本组件:声学模型、发音词典和语言模型。构建这些组件需要研究者具备语言学与技术专长,这在低资源领域是一道壁垒。无需专家领域知识即可构建这三个组件的技术需求巨大。乌尔都语尽管全球有数百万使用者,但就标准公开可用的语言资源而言是一种低资源语言。本文中,我们提出一个乌尔都语字素到音素转换工具,可从乌尔都语词表生成适用于语音识别系统的发音词典。该工具使用基于 LSTM 的模型预测词的发音,模型在约 39,000 词的人工专家词典上训练,内部评估准确率达 64%。在语音识别任务的外部评估中,我们所获词错误率与完全使用人工专家词典所得相当。

关键词

引用

@article{arxiv.1801.00409,
  title  = {PronouncUR: An Urdu Pronunciation Lexicon Generator},
  author = {Haris Bin Zia and Agha Ali Raza and Awais Athar},
  journal= {arXiv preprint arXiv:1801.00409},
  year   = {2018}
}

备注

5 pages, LREC 2018