中文

从音频深度伪造检测到 AI 生成音乐检测——一条路径与概览

声音 2024-12-11 v2 音频与语音处理

摘要

随着人工智能技术的不断发展,其用于生成逼真、情境恰当内容的应用正在拓展到各个领域。音乐作为一种艺术形式和娱乐载体,深深扎根于人类文化中,正看到 AI 参与其生产的作用日益增强。尽管 AI 音乐生成工具得到了有效应用,但其无监管的使用可能对音乐产业、版权及艺术完整性产生潜在负面影响,凸显了有效 AI 生成音乐检测的重要性。本文提供了现有 AI 生成音乐检测方法的概览。为奠定 AI 生成音乐检测通用原理与挑战的基础,我们首先回顾了 AI 生成音乐的基本原理,包括深度伪造音频的最新进展以及多模态检测技术。我们进一步提出了一种潜在路径,利用音频深度伪造检测中的基础模型应用于 AI 生成音乐检测。此外,我们讨论了这些工具的意义,并提出了未来研究的方向,以应对该领域持续存在的挑战。

关键词

引用

@article{arxiv.2412.00571,
  title  = {From Audio Deepfake Detection to AI-Generated Music Detection -- A Pathway and Overview},
  author = {Yupei Li and Manuel Milling and Lucia Specia and Björn W. Schuller},
  journal= {arXiv preprint arXiv:2412.00571},
  year   = {2024}
}