中文

Vicomtech 基于 Wav2Vec2 的音频深度伪造检测系统用于 2022 ADD 挑战赛

音频与语音处理 2022-03-04 v1 声音

摘要

本文描述了我们提交至 2022 ADD 挑战赛 track 1 与 track 2 的系统。我们的方法基于预训练的 wav2vec2 特征提取器与下游分类器的组合来检测伪造音频。该方法利用不同 transformer 层上的上下文语音表示以充分捕获判别信息。此外,分类模型通过使用不同的数据增强技术适配应用场景。我们在 ASVspoof 2021 与 2022 ADD 挑战赛上评估了我们的音频合成检测系统,展示了其在电话与音频编解码系统、含噪音频及部分深度伪造等现实挑战性环境中的鲁棒性与良好性能。

关键词

引用

@article{arxiv.2203.01573,
  title  = {The Vicomtech Audio Deepfake Detection System based on Wav2Vec2 for the 2022 ADD Challenge},
  author = {Juan M. Martín-Doñas and Aitor Álvarez},
  journal= {arXiv preprint arXiv:2203.01573},
  year   = {2022}
}

备注

Accepted by ICASSP 2022