破解语音识别器以想象歌词
人机交互
2019-12-17 v1 计算与语言
机器学习
摘要
我们提出一种基于给定音频文件类语音声学特性生成文本(尤其是歌曲歌词)的新方法。我们重新利用人声源分离算法与训练用于识别孤立语音的声学模型,转而输入器乐音乐或环境声音。将人声分离器的“错误”送入识别器,我们获得对输入音频中“想象”被说出之词的转写。我们描述了方法的关键组件,给出初步分析,并讨论了该方法在创意应用中人机协同创作的潜力。
引用
@article{arxiv.1912.06979,
title = {Breaking Speech Recognizers to Imagine Lyrics},
author = {Jon Gillick and David Bamman},
journal= {arXiv preprint arXiv:1912.06979},
year = {2019}
}
备注
3 pages