中文

基于局部时序不一致性的音视频深度伪造检测

计算机视觉与模式识别 2025-03-14 v4 密码学与安全 多媒体 声音 音频与语音处理

摘要

本文提出一种旨在捕捉音视频模态之间细粒度时序不一致性的音视频深度伪造检测方法。为实现此目标,本文引入了建构性和数据合成策略。从建构性角度,设计了时序距离图并结合注意力机制,以捕捉这些不一致性并最小化无关时序子序列的影响。此外,我们探索了新的伪深度伪造生成技术以合成局部不一致性。我们的方法使用 DFDC 和 FakeAVCeleb 数据集对比评估了最新方法,显示其在检测音视频深度伪造方面的有效性。

关键词

引用

@article{arxiv.2501.08137,
  title  = {Audio-Visual Deepfake Detection With Local Temporal Inconsistencies},
  author = {Marcella Astrid and Enjie Ghorbel and Djamila Aouada},
  journal= {arXiv preprint arXiv:2501.08137},
  year   = {2025}
}

备注

Accepted in ICASSP 2025