低资源场景下基于声学样本自动识别语系
计算与语言
2021-01-28 v1 音频与语音处理
摘要
现有的多语言语音 NLP 工作聚焦于相对少量的语言子集,因此当前对语言的认知主要源于经典方法。本工作中,我们提出一种利用深度学习分析语言相似性的方法。具体而言,我们在 Wilderness 数据集上训练一个模型,并考察其潜空间与经典语系研究结果的对比关系。我们的方法为任意基于语音的 NLP 任务中的跨语言数据增强提供了新方向。
引用
@article{arxiv.2012.00876,
title = {Automatically Identifying Language Family from Acoustic Examples in Low Resource Scenarios},
author = {Peter Wu and Yifan Zhong and Alan W Black},
journal= {arXiv preprint arXiv:2012.00876},
year = {2021}
}