中文

语音驱动服务中实用的语音重放防护

声音 2021-01-14 v1 人工智能 密码学与安全 音频与语音处理

摘要

语音驱动服务(VDS)正被用于从智能家居控制到使用数字助理进行支付的各种应用中。此类服务的输入通常在无监督环境下通过开放语音信道(例如使用麦克风)采集。该场景中的关键运行安全要求之一是输入语音的时效性。我们提出AEOLUS,一种安全覆盖层,它在用户交互时主动嵌入动态声学随机数(acoustic nonce),并检测录制语音中嵌入的随机数以确保时效性。我们证明声学随机数可以(i)被可靠地嵌入与提取,且(ii)对VDS用户无干扰(甚至不可感知)。从实用角度为(i)和(ii)确定了最优参数(声学随机数的工作频率、振幅与比特率)。实验结果表明,在三种具有不同背景噪声水平的真实环境中,AEOLUS在4米距离内实现0%误受率(FAR)下0.5%误拒率(FRR)的语音重放防护。我们还进行了120名参与者的用户研究,表明在这些环境中平均94.16%的语音样本声学随机数未降低整体用户体验。因此AEOLUS可实际用于防止语音重放并确保语音输入的时效性。

关键词

引用

@article{arxiv.2101.04773,
  title  = {Practical Speech Re-use Prevention in Voice-driven Services},
  author = {Yangyong Zhang and Maliheh Shirvanian and Sunpreet S. Arora and Jianwei Huang and Guofei Gu},
  journal= {arXiv preprint arXiv:2101.04773},
  year   = {2021}
}