Wiki-En-ASR-Adapt:用于英语 ASR 定制的大规模合成数据集
音频与语音处理
2023-10-02 v1 计算与语言
声音
摘要
我们提出首个用于自动语音识别(ASR)上下文拼写纠错定制的大规模公共合成数据集,重点关注多样化的罕见词与词汇外(OOV)短语,如专有名称或术语。所提方法可生成数百万个真实的 corrupted ASR 假设示例,并为定制任务模拟非平凡的偏置列表。此外,我们提出在训练示例的模拟偏置列表中注入两类“困难负样本”,并描述了自动挖掘这些负样本的流程。我们报告了使用所提数据集训练开源定制模型的实验,结果表明困难负样本偏置短语的注入降低了词错误率(WER)与误报数量。
引用
@article{arxiv.2309.17267,
title = {Wiki-En-ASR-Adapt: Large-scale synthetic dataset for English ASR Customization},
author = {Alexandra Antonova},
journal= {arXiv preprint arXiv:2309.17267},
year = {2023}
}
备注
Accepted to IEEE ASRU 2023