利用深度学习控制对话增强中感知声音质量
音频与语音处理
2021-07-23 v1 声音
摘要
语音增强可衰减语音信号中的干扰声,但可能引入可感知地劣化输出信号的伪影。我们提出一种控制干扰背景信号衰减与声音质量损失之间权衡的方法。深度神经网络估计分离背景信号的衰减量,使得以Artifact-related Perceptual Score量化的声音质量满足可调目标。主观评价表明,在不同输入信号间获得了一致的声音质量。我们的实验显示,所提方法能够以足以用于现实世界对话增强应用的精度控制该权衡。
引用
@article{arxiv.2107.10562,
title = {Controlling the Perceived Sound Quality for Dialogue Enhancement with Deep Learning},
author = {Christian Uhle and Matteo Torcoli and Jouni Paulus},
journal= {arXiv preprint arXiv:2107.10562},
year = {2021}
}
备注
Accepted paper at ICASSP 2020