语音克隆的主动检测:局部化水印技术
声音
2024-06-07 v2 人工智能
密码学与安全
摘要
在快速发展的语音生成模型领域,迫切需要确保音频真实性,以应对语音克隆的风险。我们提出 AudioSeal,这是首个专为局部化检测人工智能生成语音而设计的音频水印技术。AudioSeal 采用生成器/检测器架构,通过联合训练局部化损失函数,实现对音频样本级别的局部化水印检测;并引入一种新颖的感知损失,灵感来自听觉遮蔽,使 AudioSeal 在鲁棒性和不可感知性方面实现最新进展。基于自动和人类评估指标,AudioSeal 在鲁棒性和不可感知性方面均实现最新表现。此外,AudioSeal 采用快速单遍检测器,显著优于现有模型的速度——实现约快两个数量级,适用于大规模和实时应用。
引用
@article{arxiv.2401.17264,
title = {Proactive Detection of Voice Cloning with Localized Watermarking},
author = {Robin San Roman and Pierre Fernandez and Alexandre Défossez and Teddy Furon and Tuan Tran and Hady Elsahar},
journal= {arXiv preprint arXiv:2401.17264},
year = {2024}
}
备注
Published at ICML 2024. Code at https://github.com/facebookresearch/audioseal - webpage at https://pierrefdz.github.io/publications/audioseal/