用于改进歌曲检索的多模态副歌识别
信息检索
2021-07-01 v1 声音
音频与语音处理
摘要
我们讨论了一项新任务——副歌识别,它有可能惠及歌曲检索和音乐摘要等下游任务。不同于已有的依赖单模态信息的音乐摘要或歌词摘要等任务,本文利用歌曲的歌词与曲调信息将副歌识别建模为多模态任务。我们提出了一种考虑多种特征的多模态副歌识别模型。此外,我们还创建并发布了首个包含 627 首歌曲的副歌识别数据集以供公开使用。我们在该数据集上的实证研究表明,我们的方法在副歌识别上优于若干基线。此外,我们的方法还将其下游任务——歌曲检索的准确率提升了 10.6% 以上。
引用
@article{arxiv.2106.16153,
title = {Multi-Modal Chorus Recognition for Improving Song Search},
author = {Jiaan Wang and Zhixu Li and Binbin Gu and Tingyi Zhang and Qingsheng Liu and Zhigang Chen},
journal= {arXiv preprint arXiv:2106.16153},
year = {2021}
}
备注
Accepted at the 30th International Conference on Artificial Neural Networks (ICANN 2021)