中文

将 NURC/SP 带入数字生活:开源自动语音识别模型的作用

计算与语言 2022-10-17 v1 声音 音频与语音处理

摘要

NURC 项目始于 1969 年,旨在研究巴西五个首都城市中有教养的城市语言规范,负责为每个首都编纂大型语料库。数字化的 NURC/SP 包含来自圣保罗首都的 375 次访谈,共计 334 小时录音。尽管有 47 次访谈已转录,但音频与转录之间并无对齐,且 328 次访谈未被转录。本文对三个使用葡萄牙语自发语音训练以及一个使用准备型语音训练的自动语音识别模型进行了评估与错误分析。该评估使我们能够在 NURC/SP 的人工对齐样本上,利用 WER 和 CER 指标选出最佳模型,以自动转录 284 小时的录音。

关键词

引用

@article{arxiv.2210.07852,
  title  = {Bringing NURC/SP to Digital Life: the Role of Open-source Automatic Speech Recognition Models},
  author = {Lucas Rafael Stefanel Gris and Arnaldo Candido Junior and Vinícius G. dos Santos and Bruno A. Papa Dias and Marli Quadros Leite and Flaviane Romani Fernandes Svartman and Sandra Aluísio},
  journal= {arXiv preprint arXiv:2210.07852},
  year   = {2022}
}