中文

破解语音识别器以想象歌词

人机交互 2019-12-17 v1 计算与语言 机器学习

摘要

我们提出一种基于给定音频文件类语音声学特性生成文本(尤其是歌曲歌词)的新方法。我们重新利用人声源分离算法与训练用于识别孤立语音的声学模型,转而输入器乐音乐或环境声音。将人声分离器的“错误”送入识别器,我们获得对输入音频中“想象”被说出之词的转写。我们描述了方法的关键组件,给出初步分析,并讨论了该方法在创意应用中人机协同创作的潜力。

关键词

引用

@article{arxiv.1912.06979,
  title  = {Breaking Speech Recognizers to Imagine Lyrics},
  author = {Jon Gillick and David Bamman},
  journal= {arXiv preprint arXiv:1912.06979},
  year   = {2019}
}

备注

3 pages