中文

Wiki-En-ASR-Adapt:用于英语 ASR 定制的大规模合成数据集

音频与语音处理 2023-10-02 v1 计算与语言 声音

摘要

我们提出首个用于自动语音识别(ASR)上下文拼写纠错定制的大规模公共合成数据集,重点关注多样化的罕见词与词汇外(OOV)短语,如专有名称或术语。所提方法可生成数百万个真实的 corrupted ASR 假设示例,并为定制任务模拟非平凡的偏置列表。此外,我们提出在训练示例的模拟偏置列表中注入两类“困难负样本”,并描述了自动挖掘这些负样本的流程。我们报告了使用所提数据集训练开源定制模型的实验,结果表明困难负样本偏置短语的注入降低了词错误率(WER)与误报数量。

关键词

引用

@article{arxiv.2309.17267,
  title  = {Wiki-En-ASR-Adapt: Large-scale synthetic dataset for English ASR Customization},
  author = {Alexandra Antonova},
  journal= {arXiv preprint arXiv:2309.17267},
  year   = {2023}
}

备注

Accepted to IEEE ASRU 2023