中文

AP17-OLR 挑战赛:数据、计划与基线

计算与语言 2017-06-30 v1

摘要

我们介绍了第二届东方语言识别(OLR)挑战赛 AP17-OLR 的数据概况和评估计划。与去年的事件(AP16-OLR)相比,新挑战赛涉及更多语言,并更关注短语音片段。数据由 SpeechOcean 和 NSFC M2ASR 项目提供。构建了两类基线以协助参与者,一类基于 i-vector 模型,另一类基于各种神经网络。我们报告了使用 AP17-OLR 评估计划定义的多种指标评估的基线结果,并证明该组合数据库是多语言研究的合理数据资源。所有数据对参与者免费,且基线的 Kaldi 配方已在线发布。

关键词

引用

@article{arxiv.1706.09742,
  title  = {AP17-OLR Challenge: Data, Plan, and Baseline},
  author = {Zhiyuan Tang and Dong Wang and Yixiang Chen and Qing Chen},
  journal= {arXiv preprint arXiv:1706.09742},
  year   = {2017}
}

备注

Submitted to APSIPA ASC 2017. arXiv admin note: text overlap with arXiv:1609.08445