大规模多语言对抗语音识别
计算与语言
2019-04-05 v1 机器学习
摘要
我们报告了在多至 100 种语言上训练的多语言端到端语音识别模型的适配情况。我们的发现阐明了目标语言与预训练语言之间在语音学、音系学、语系、地理位置和正字法维度上相似性的相对重要性。在此背景下,实验证明了两个额外的预训练目标在促进语言无关编码器表示方面的有效性:一个与上下文无关的音素目标与一个语言对抗分类目标相结合。
引用
@article{arxiv.1904.02210,
title = {Massively Multilingual Adversarial Speech Recognition},
author = {Oliver Adams and Matthew Wiesner and Shinji Watanabe and David Yarowsky},
journal= {arXiv preprint arXiv:1904.02210},
year = {2019}
}
备注
Accepted at NAACL-HLT 2019