中文

基于 EEG 与视频的连续语音识别

机器学习 2020-01-01 v5 音频与语音处理 图像与视频处理 机器学习

摘要

在本文中,我们研究脑电图(EEG)特征是否可用于提升连续视觉语音识别系统的性能。我们实现了一个基于连接时序分类(CTC)的端到端自动语音识别(ASR)模型来进行识别。我们的结果表明,EEG 特征有助于增强连续视觉语音识别系统的性能。

关键词

引用

@article{arxiv.1912.07730,
  title  = {Continuous Speech Recognition using EEG and Video},
  author = {Gautam Krishna and Mason Carnahan and Co Tran and Ahmed H Tewfik},
  journal= {arXiv preprint arXiv:1912.07730},
  year   = {2020}
}

备注

On preparation for submission to EUSIPCO 2020. arXiv admin note: text overlap with arXiv:1911.11610, arXiv:1911.04261