印度英语发音相对于标准英式发音的变异性研究
计算与语言
2022-12-12 v2
摘要
分析印度英语(IE)发音变异性有助于在印度语境下构建自动语音识别(ASR)与语音合成(TTS)系统。通常,这些发音变异性通过将 IE 发音与标准英式发音(RP)比较来探究。然而,探究这些变异性需要音素级别的标注发音数据,而 IE 此类数据稀缺。此外,IE 的多样性源于说话者母语与人口区域差异的广泛影响。以往语言学工作通过报告相对于 RP 表征此类变化的音素规则,对 IE 变异性特征进行了定性刻画。这些定性描述常缺乏定量描述符,也未对多样化 IE 发音数据进行数据驱动分析以在音素层面刻画 IE。为解决这些问题,本文采用 Indic TIMIT 语料库,其包含来自印度各地 80 名说话者的广泛 IE 变体。我们提出一种分析以数据驱动方式获取表征 IE 相对于 RP 发音变异性的新音素规则集。我们利用 15,974 条音素转写实现此目的,其中 13,632 条为人工标注,其余来自语料库。进而,我们依据现有音素规则验证分析所得规则,以确认其相关性,并基于所得规则构建字素到音素(G2P)转换,以音素错误率(PER)为性能指标检验其效能。
引用
@article{arxiv.2204.06502,
title = {Study of Indian English Pronunciation Variabilities relative to Received Pronunciation},
author = {Priyanshi Pal and Shelly Jain and Anil Vuppala and Chiranjeevi Yarra and Prasanta Ghosh},
journal= {arXiv preprint arXiv:2204.06502},
year = {2022}
}