利用logit加噪检测音频对抗样本
密码学与安全
2021-12-14 v1 声音
音频与语音处理
摘要
自动语音识别(ASR)系统易受音频对抗样本的攻击,此类样本通过向良性语音信号添加扰动来欺骗ASR系统。尽管对抗样本与原始良性波形对人而言无法区分,但前者被ASR系统转写为恶意目标句子。已有若干方法被提出以生成音频对抗样本并直接输入ASR系统(over-line)。此外,许多研究者证明了鲁棒物理音频对抗样本(over-air)的可行性。为防御此类攻击,已有若干研究被提出。然而,由于准确率下降或时间开销,将其部署于真实场景较为困难。本文中,我们提出一种新颖方法,通过在将logits输入ASR解码器之前向其添加噪声来检测音频对抗样本。我们表明,精心选择的噪声可显著影响音频对抗样本的转写结果,而对良性音频波形的转写结果影响极小。基于该特性,我们通过比较经logit加噪改变的转写与其原始转写来检测音频对抗样本。所提方法无需任何结构改动或额外训练即可轻松应用于ASR系统。实验结果显示,与最先进检测方法相比,所提方法对over-line音频对抗样本及over-air音频对抗样本均具有鲁棒性。
引用
@article{arxiv.2112.06443,
title = {Detecting Audio Adversarial Examples with Logit Noising},
author = {Namgyu Park and Sangwoo Ji and Jong Kim},
journal= {arXiv preprint arXiv:2112.06443},
year = {2021}
}
备注
10 pages, 12 figures, In Proceedings of the 37th Annual Computer Security Applications Conference (ACSAC) 2021