GIPFA:从音频生成国际音标发音
计算与语言
2021-09-23 v2 声音
音频与语音处理
摘要
将口语音频样本转写为国际音标(IPA)长期以来一直是专家的专属领域。在本研究中,我们探讨了使用人工神经网络(ANN)模型,根据单词的音频发音自动提取其 IPA 音位发音,因此将其命名为从音频生成国际音标发音(GIPFA)。基于法语维基词典,我们训练了模型,该模型随后正确预测了 75% 的测试 IPA 发音。有趣的是,通过研究推理错误,该模型使得发现数据集中可能存在的错误以及识别法语中最接近的音位成为可能。
引用
@article{arxiv.2006.07573,
title = {GIPFA: Generating IPA Pronunciation from Audio},
author = {Xavier Marjou},
journal= {arXiv preprint arXiv:2006.07573},
year = {2021}
}
备注
10 pages, 2 figures, 7 tables