利用节奏信息增强伪造语音检测
音频与语音处理
2023-11-28 v2
摘要
当前的伪造语音检测系统需要更具说服力的证据。本文分析了 TTS 生成语音中节奏信息固有的缺陷,以提升检测系统的可靠性。TTS 模型以文本为输入,并利用声学模型预测节奏信息,从而在节奏信息中引入伪影。通过滤除声道响应,剩余的带有节奏信息的声门气流保留了针对 TTS 生成语音的检测能力。基于这些分析,提出一种节奏扰动模块以增强复制合成数据增广方法。该方法生成的假语音迫使检测模型关注节奏信息中的伪影,并有效提升了反欺骗对策检测 TTS 生成语音的能力。
引用
@article{arxiv.2310.12014,
title = {Enhancing Spoofing Speech Detection Using Rhythm Information},
author = {Jingze Lu and Yuxiang Zhang and Wenchao Wang and Zengqiang Shang and Pengyuan Zhang},
journal= {arXiv preprint arXiv:2310.12014},
year = {2023}
}
备注
Five pages, two figures