AP17-OLR 挑战赛:数据、计划与基线
计算与语言
2017-06-30 v1
摘要
我们介绍了第二届东方语言识别(OLR)挑战赛 AP17-OLR 的数据概况和评估计划。与去年的事件(AP16-OLR)相比,新挑战赛涉及更多语言,并更关注短语音片段。数据由 SpeechOcean 和 NSFC M2ASR 项目提供。构建了两类基线以协助参与者,一类基于 i-vector 模型,另一类基于各种神经网络。我们报告了使用 AP17-OLR 评估计划定义的多种指标评估的基线结果,并证明该组合数据库是多语言研究的合理数据资源。所有数据对参与者免费,且基线的 Kaldi 配方已在线发布。
引用
@article{arxiv.1706.09742,
title = {AP17-OLR Challenge: Data, Plan, and Baseline},
author = {Zhiyuan Tang and Dong Wang and Yixiang Chen and Qing Chen},
journal= {arXiv preprint arXiv:1706.09742},
year = {2017}
}
备注
Submitted to APSIPA ASC 2017. arXiv admin note: text overlap with arXiv:1609.08445