中文

用户生成音频内容的自动组织、分割与过滤

音频与语音处理 2017-09-18 v1 信息检索 多媒体 声音

摘要

仅使用音频指纹技术检索到的信息,我们提出了处理可能庞大的用户生成音频内容数据集的方法,这些方法 能够将包含共同音频片段(即属于同一事件)的多个音频文件进行分组,并 提供有关在每个事件内这些文件在时间和质量方面如何相关的信息。此外,我们使用监督学习来检测可能由音频指纹算法本身引起的错误匹配,同时确保我们的模型从先前的预测中学习。所有提出的方法均通过手动从 YouTube 抓取的几场不同音乐会的用户生成录音进行了进一步验证。

关键词

引用

@article{arxiv.1708.05302,
  title  = {Automatic Organisation, Segmentation, and Filtering of User-Generated Audio Content},
  author = {Gonçalo Mordido and João Magalhães and Sofia Cavaco},
  journal= {arXiv preprint arXiv:1708.05302},
  year   = {2017}
}

备注

MMSP 2017 - IEEE 19th International Workshop on Multimedia Signal Processing