中文

PERSA+:一种面向上下文无关音频分类的深度学习前端

声音 2021-07-21 v1 音频与语音处理

摘要

深度学习已被应用于多样的音频语义任务,使得能够从高维原始数据中学习分层特征并达到最先进的性能。但这些算法在真实世界条件下是否表现相似,还是仅在基准上表现良好——其高学习能力确保了对所用数据集的完全记忆?本工作提出了一种深度学习前端,旨在进入建模阶段之前丢弃有害信息,使学习过程更贴近要点,推动鲁棒且上下文无关的分类算法的发展。

关键词

引用

@article{arxiv.2107.09311,
  title  = {PERSA+: A Deep Learning Front-End for Context-Agnostic Audio Classification},
  author = {Lazaros Vrysis and Iordanis Thoidis and Charalampos Dimoulas and George Papanikolaou},
  journal= {arXiv preprint arXiv:2107.09311},
  year   = {2021}
}