基于WaveNet的低速率语音编码
音频与语音处理
2017-12-05 v1 声音
信号处理
摘要
传统的语音参数化编码实现了低速率,但由于所用模型的不足而重建质量较差。我们描述了如何使用WaveNet生成式语音模型,从以2.4 kb/s工作的标准参数化编码器的比特流中生成高质量语音。我们将该参数化编码器与基于同一生成模型的波形编码器进行比较,表明对信号波形的逼近会带来很大的速率代价。我们的实验证实了基于WaveNet的编码器的高性能,并表明该系统产生的语音能够额外进行隐式带宽扩展,且即使该说话人未用于生成模型的训练,也不会显著损害人类听者对原说话人的辨识。
引用
@article{arxiv.1712.01120,
title = {Wavenet based low rate speech coding},
author = {W. Bastiaan Kleijn and Felicia S. C. Lim and Alejandro Luebs and Jan Skoglund and Florian Stimberg and Quan Wang and Thomas C. Walters},
journal= {arXiv preprint arXiv:1712.01120},
year = {2017}
}
备注
5 pages, 2 figures