面向单阶与多阶音频重放攻击的语音欺骗检测语料库
声音
2019-09-04 v1 音频与语音处理
摘要
近年来现代语音控制设备(VCDs)的发展革新了物联网,并通过语音指令实现了智能家居、个性化与家庭自动化的日益普及。VCDs 在物联网中的引入有望催生物联网的新子领域,称为物多媒体(MoT)。这些 VCDs 可在物联网驱动环境中被利用来生成包括重放攻击在内的各种欺骗攻击。重放攻击通过回放合法人类说话人的录音来欺骗具有说话人验证系统的 VCDs。VCDs 之间的连通性在物联网驱动环境中可轻易被利用来生成一连串重放攻击(多阶重放攻击)。现有的欺骗检测数据集如 ASVspoof 和 ReMASC 仅包含针对真实音频样本的一阶重放录音。这些数据集无法对能够检测多阶重放攻击的反欺骗算法进行评估。此外,这些数据集未捕获麦克风阵列的特性,而这是现代 VCDs 的重要特征。我们需要一个由针对真实语音样本的多阶重放录音组成的多样化重放欺骗检测语料库。本文提出一种新颖的语音欺骗检测语料库(VSDC)来评估多阶重放反欺骗方法的性能。所提出的 VSDC 包含针对真实音频录音的一阶和二阶重放样本。此外,由于我们语料库包含十五位不同说话人的音频样本,所提出的 VSDC 也可用于评估说话人验证系统的性能。据我们所知,这是首个公开可用的包含一阶和二阶重放样本的回放欺骗检测语料库。
引用
@article{arxiv.1909.00935,
title = {Voice Spoofing Detection Corpus for Single and Multi-order Audio Replays},
author = {Roland Baumann and Khalid Mahmood Malik and Ali Javed and Andersen Ball and Brandon Kujawa and Hafiz Malik},
journal= {arXiv preprint arXiv:1909.00935},
year = {2019}
}