中文

基于高斯混合模型的现代喉切除患者语音变换方法分析

声音 2020-09-08 v1 多媒体 音频与语音处理

摘要

本文提出了一种针对喉切除患者的语音变换系统,喉切除术是指切除全部或部分喉(声带盒)的外科手术,常用于喉癌病例。实现语音变换的一种原始方法是提取源说话人的声道系数,然后将其转换为目标说话人的声道参数。在本文中,我们部署高斯混合模型(GMM)将系数从源映射到目标。然而,使用传统/常规的基于 GMM 的映射方法会导致转换后的语音出现过度平滑的问题。因此,我们在此提出一种基于 GMM 的独特方法以执行高效的语音变换和转换,该方法克服了传统方法导致的过度平滑效应。它采用了声门波形分离和激励预测技术,结果表明不仅消除了过度平滑,而且变换后的声道参数与目标匹配。此外,发现由此获得的合成语音具有足够高的质量。因此,本文提出并基于各种主观和客观评估参数严格评估了基于独特 GMM 方法的语音变换。此外,本文推荐了一种部署此独特方法的喉切除患者语音变换应用。

关键词

引用

@article{arxiv.1208.1418,
  title  = {Analysis of a Modern Voice Morphing Approach using Gaussian Mixture Models for Laryngectomees},
  author = {Aman Chadha and Bharatraaj Savardekar and Jay Padhya},
  journal= {arXiv preprint arXiv:1208.1418},
  year   = {2020}
}

备注

6 pages, 4 figures, 4 tables; International Journal of Computer Applications Volume 49, Number 21, July 2012