利用头像指纹技术:多生成器的photorealistic说话-头像公开数据库与基准
计算机视觉与模式识别
2026-03-31 v1
摘要
近期的photorealistic头像生成技术进展使高度逼真的说话-头像_avatar 成为可能,引发了关于AI中介沟通中身份冒充的安全隐忧。为应对这一挑战,_avatar 指纹识别任务旨在确定两个_avatar 视频是否由同一人操作驱动。然而,当前文献中的公开数据库稀缺且仅基于传统说话-头像生成器,无法代表当前_avatar 指纹识别任务的真实场景。为克服这一局限,本文引入AVAPrintDB——一个面向_avatar 指纹识别的多生成器说话-头像数据库。AVAPrintDB由两个音视频语料库和三个最新_avatar 生成器(GAGAvatar、LivePortrait、HunyuanPortrait)构建,涵盖不同的合成范式,包含自再现和跨再现,以模拟合法使用和冒充情境。基于该数据库,我们还定义了标准化且可复现的_avatar 指纹基准,考虑公开的最新_avatar 指纹系统并探索基于Foundation模型(DINOv2和CLIP)的方法。我们还进行了针对生成器和数据集迁移的全面分析。结果表明,尽管身份相关运动线索在合成_avatar之间保持一致,但当前的_avatar 指纹系统对合成管道和源域的变化高度敏感。AVAPrintDB、基准协议以及_avatar 指纹系统均公开可用,以促进可复现的研究。
引用
@article{arxiv.2603.26934,
title = {Leveraging Avatar Fingerprinting: A Multi-Generator Photorealistic Talking-Head Public Database and Benchmark},
author = {Laura Pedrouzo-Rodriguez and Luis F. Gomez and Ruben Tolosana and Ruben Vera-Rodriguez and Roberto Daza and Aythami Morales and Julian Fierrez},
journal= {arXiv preprint arXiv:2603.26934},
year = {2026}
}