中文

基于 CNN 与 Vision Transformer 的 AI 深度伪造检测

计算机视觉与模式识别 2026-01-06 v1 人工智能 机器学习

摘要

人工智能生成的深度伪造 (deepfake) 日益增多,构成维护数字真实性的重大挑战。本文评估了四个基于 AI 的模型(包括三个 CNN 和一个 Vision Transformer)在大型人脸图像数据集上的表现。数据预处理和增强技术提升了模型在不同情景下的性能。VFDNET 采用 MobileNetV3 展现出卓越的准确率,显示出高效性能,进而表明 AI 具备可靠的深度伪造检测能力。

关键词

引用

@article{arxiv.2601.01281,
  title  = {AI-Powered Deepfake Detection Using CNN and Vision Transformer Architectures},
  author = {Sifatullah Sheikh Urmi and Kirtonia Nuzath Tabassum Arthi and Md Al-Imran},
  journal= {arXiv preprint arXiv:2601.01281},
  year   = {2026}
}

备注

6 pages, 6 figures, 3 tables. Conference paper