中文

音频深度伪造检测:综述

声音 2023-08-30 v1 音频与语音处理

摘要

音频深度伪造检测是一个新兴的活跃课题。越来越多的文献致力于研究深度伪造检测算法并取得了有效性能,但该问题远未解决。尽管已有一些综述文献,尚缺乏提供统一评估、为研究者系统概述这些进展的全面综述。据此,本综述论文首先强调各类深度伪造音频之间的关键差异,随后概述并分析最先进方法的竞赛、数据集、特征、分类与评估。对于每个方面,均讨论了基本技术、先进进展与主要挑战。此外,我们分别在 ASVspoof 2021、ADD 2023 和 In-the-Wild 数据集上,对代表性特征与分类器进行统一比较以用于音频深度伪造检测。该综述表明,未来研究应解决真实场景下大规模数据集的缺乏、现有检测方法对未知伪造攻击的泛化性差,以及检测结果可解释性等问题。

关键词

引用

@article{arxiv.2308.14970,
  title  = {Audio Deepfake Detection: A Survey},
  author = {Jiangyan Yi and Chenglong Wang and Jianhua Tao and Xiaohui Zhang and Chu Yuan Zhang and Yan Zhao},
  journal= {arXiv preprint arXiv:2308.14970},
  year   = {2023}
}