音频深度伪造检测:综述
声音
2023-08-30 v1 音频与语音处理
摘要
音频深度伪造检测是一个新兴的活跃课题。越来越多的文献致力于研究深度伪造检测算法并取得了有效性能,但该问题远未解决。尽管已有一些综述文献,尚缺乏提供统一评估、为研究者系统概述这些进展的全面综述。据此,本综述论文首先强调各类深度伪造音频之间的关键差异,随后概述并分析最先进方法的竞赛、数据集、特征、分类与评估。对于每个方面,均讨论了基本技术、先进进展与主要挑战。此外,我们分别在 ASVspoof 2021、ADD 2023 和 In-the-Wild 数据集上,对代表性特征与分类器进行统一比较以用于音频深度伪造检测。该综述表明,未来研究应解决真实场景下大规模数据集的缺乏、现有检测方法对未知伪造攻击的泛化性差,以及检测结果可解释性等问题。
引用
@article{arxiv.2308.14970,
title = {Audio Deepfake Detection: A Survey},
author = {Jiangyan Yi and Chenglong Wang and Jianhua Tao and Xiaohui Zhang and Chu Yuan Zhang and Yan Zhao},
journal= {arXiv preprint arXiv:2308.14970},
year = {2023}
}