中文

SpMis:一项关于合成语音虚假信息检测的研究

计算与语言 2024-09-18 v1

摘要

近年来,在生成模型和大规模训练技术的推动下,语音生成技术发展迅速。虽然这些进展使得高质量合成语音的生产成为可能,但也引发了人们对这项技术被滥用的担忧,特别是用于生成合成虚假信息。当前的研究主要集中在区分机器生成的语音和人类产生的语音,但更紧迫的挑战是检测语音内容中的虚假信息。这项任务需要对说话人身份、主题和合成等因素进行深入分析。为了满足这一需求,我们通过引入一个开源数据集SpMis,对合成语音虚假信息检测进行了初步研究。SpMis包含利用最先进的文本到语音系统,从超过1000名说话人、涵盖五个常见主题合成的语音。尽管我们的结果显示出有前景的检测能力,但也揭示了实际应用中的重大挑战,凸显了在这一关键领域持续研究的重要性。

关键词

引用

@article{arxiv.2409.11308,
  title  = {SpMis: An Investigation of Synthetic Spoken Misinformation Detection},
  author = {Peizhuo Liu and Li Wang and Renqiang He and Haorui He and Lei Wang and Huadi Zheng and Jie Shi and Tong Xiao and Zhizheng Wu},
  journal= {arXiv preprint arXiv:2409.11308},
  year   = {2024}
}

备注

Accepted in SLT 2024