语音驱动服务中实用的语音重放防护
声音
2021-01-14 v1 人工智能
密码学与安全
音频与语音处理
摘要
语音驱动服务(VDS)正被用于从智能家居控制到使用数字助理进行支付的各种应用中。此类服务的输入通常在无监督环境下通过开放语音信道(例如使用麦克风)采集。该场景中的关键运行安全要求之一是输入语音的时效性。我们提出AEOLUS,一种安全覆盖层,它在用户交互时主动嵌入动态声学随机数(acoustic nonce),并检测录制语音中嵌入的随机数以确保时效性。我们证明声学随机数可以(i)被可靠地嵌入与提取,且(ii)对VDS用户无干扰(甚至不可感知)。从实用角度为(i)和(ii)确定了最优参数(声学随机数的工作频率、振幅与比特率)。实验结果表明,在三种具有不同背景噪声水平的真实环境中,AEOLUS在4米距离内实现0%误受率(FAR)下0.5%误拒率(FRR)的语音重放防护。我们还进行了120名参与者的用户研究,表明在这些环境中平均94.16%的语音样本声学随机数未降低整体用户体验。因此AEOLUS可实际用于防止语音重放并确保语音输入的时效性。
引用
@article{arxiv.2101.04773,
title = {Practical Speech Re-use Prevention in Voice-driven Services},
author = {Yangyong Zhang and Maliheh Shirvanian and Sunpreet S. Arora and Jianwei Huang and Guofei Gu},
journal= {arXiv preprint arXiv:2101.04773},
year = {2021}
}