中文

基于WaveNet的低速率语音编码

音频与语音处理 2017-12-05 v1 声音 信号处理

摘要

传统的语音参数化编码实现了低速率,但由于所用模型的不足而重建质量较差。我们描述了如何使用WaveNet生成式语音模型,从以2.4 kb/s工作的标准参数化编码器的比特流中生成高质量语音。我们将该参数化编码器与基于同一生成模型的波形编码器进行比较,表明对信号波形的逼近会带来很大的速率代价。我们的实验证实了基于WaveNet的编码器的高性能,并表明该系统产生的语音能够额外进行隐式带宽扩展,且即使该说话人未用于生成模型的训练,也不会显著损害人类听者对原说话人的辨识。

关键词

引用

@article{arxiv.1712.01120,
  title  = {Wavenet based low rate speech coding},
  author = {W. Bastiaan Kleijn and Felicia S. C. Lim and Alejandro Luebs and Jan Skoglund and Florian Stimberg and Quan Wang and Thomas C. Walters},
  journal= {arXiv preprint arXiv:1712.01120},
  year   = {2017}
}

备注

5 pages, 2 figures