对抗音频:一种面向基于DNN语音识别模型的新型信息隐藏方法与后门
密码学与安全
2019-04-09 v1 声音
音频与语音处理
摘要
音频是人们日常生活中的重要媒介,隐藏信息可嵌入音频中以进行隐蔽通信。当前的音频信息隐藏技术大致可分为基于时域和基于变换域的技术。基于时域的技术隐藏容量大但不可感知性差。基于变换域的技术不可感知性较好,但隐藏容量差。本文提出一种具有高隐藏容量和良好不可感知性的新型音频信息隐藏技术。所提音频信息隐藏方法以原始音频信号为输入,通过我们私有的自动语音识别(ASR)模型训练获得嵌入隐藏信息的音频信号(称为隐写音频)。在不知晓私有模型内部参数与结构的情况下,隐藏信息可由私有模型提取而无法由公开模型提取。我们使用另外四种ASR模型在隐写音频上提取隐藏信息以评估私有模型的安全性。实验结果表明,所提音频信息隐藏技术具有48 cps的高隐藏容量,且不可感知性好、安全性高。此外,我们提出的对抗音频可用于激活基于DNN的ASR模型的固有后门,这对智能音箱带来严重威胁。
引用
@article{arxiv.1904.03829,
title = {Adversarial Audio: A New Information Hiding Method and Backdoor for DNN-based Speech Recognition Models},
author = {Yehao Kong and Jiliang Zhang},
journal= {arXiv preprint arXiv:1904.03829},
year = {2019}
}
备注
Submitted to RAID2019