中文

Deep Audio Analyzer:一个使音频取证研究工业化的框架

声音 2023-10-31 v1 音频与语音处理

摘要

Deep Audio Analyzer 是一个开源语音框架,旨在简化神经语音处理流水线的研究与开发过程,使用户能够以快速且可复现的方式构思、比较和共享结果。本文描述了为支撑音频取证领域若干共同关注任务而设计的核心架构,展示了创建新任务从而定制框架的可能性。借助 Deep Audio Analyzer,取证审查员(如来自执法机构者)与研究人员将能够可视化音频特征、轻松评估预训练模型上的性能,并通过将深度神经网络模型以数次点击组合来创建、导出和共享新的音频分析工作流。该工具的优势之一是在音频取证分析领域加速研究与实用实验,从而也通过导出和共享流水线提升实验可复现性。所有功能均以模块开发,用户可通过图形用户界面访问。索引术语:语音处理,深度学习音频,深度学习音频流水线创建,音频取证。

关键词

引用

@article{arxiv.2310.19081,
  title  = {Deep Audio Analyzer: a Framework to Industrialize the Research on Audio Forensics},
  author = {Valerio Francesco Puglisi and Oliver Giudice and Sebastiano Battiato},
  journal= {arXiv preprint arXiv:2310.19081},
  year   = {2023}
}