中文

用于改进歌曲检索的多模态副歌识别

信息检索 2021-07-01 v1 声音 音频与语音处理

摘要

我们讨论了一项新任务——副歌识别,它有可能惠及歌曲检索和音乐摘要等下游任务。不同于已有的依赖单模态信息的音乐摘要或歌词摘要等任务,本文利用歌曲的歌词与曲调信息将副歌识别建模为多模态任务。我们提出了一种考虑多种特征的多模态副歌识别模型。此外,我们还创建并发布了首个包含 627 首歌曲的副歌识别数据集以供公开使用。我们在该数据集上的实证研究表明,我们的方法在副歌识别上优于若干基线。此外,我们的方法还将其下游任务——歌曲检索的准确率提升了 10.6% 以上。

关键词

引用

@article{arxiv.2106.16153,
  title  = {Multi-Modal Chorus Recognition for Improving Song Search},
  author = {Jiaan Wang and Zhixu Li and Binbin Gu and Tingyi Zhang and Qingsheng Liu and Zhigang Chen},
  journal= {arXiv preprint arXiv:2106.16153},
  year   = {2021}
}

备注

Accepted at the 30th International Conference on Artificial Neural Networks (ICANN 2021)