Half-Truth:一个部分伪造音频检测数据集
声音
2023-12-19 v2 人工智能
计算与语言
音频与语音处理
摘要
为遏制伪造音频检测的发展,人们设计了多种有前景的数据集,如 ASVspoof 数据库。然而,先前的数据集忽略了一种攻击情形,即黑客将一些小的伪造片段隐藏在真实语音音频中。这构成了严重威胁,因为难以从整个语音语句中分辨出小的伪造片段。因此,本文开发了这样一个用于半真音频检测(HAD)的数据集。HAD 数据集中的部分伪造音频仅涉及更改语句中的少数词。这些词的音频由最新最先进的语音合成技术生成。利用该数据集,我们不仅能检测伪造语句,还能定位语音中被篡改的区域。本文给出了在该数据集上的一些基准结果。结果表明,对于伪造音频检测,部分伪造音频比完全伪造音频更具挑战性。HAD 数据集公开可用:https://zenodo.org/records/10377492。
引用
@article{arxiv.2104.03617,
title = {Half-Truth: A Partially Fake Audio Detection Dataset},
author = {Jiangyan Yi and Ye Bai and Jianhua Tao and Haoxin Ma and Zhengkun Tian and Chenglong Wang and Tao Wang and Ruibo Fu},
journal= {arXiv preprint arXiv:2104.03617},
year = {2023}
}
备注
accepted by Interspeech 2021