中文

具有神经增量 ASR、MT 和 TTS 的同步语音到语音翻译系统

计算与语言 2020-11-12 v2

摘要

本文介绍了一个新开发的同步神经语音到语音翻译系统及其评估。该系统由三个完全增量的神经处理模块组成,分别用于自动语音识别(ASR)、机器翻译(MT)和文本到语音合成(TTS)。我们研究了系统在耳语跨度(Ear-Voice Span)和说话延迟方面的整体延迟以及模块级性能。

关键词

引用

@article{arxiv.2011.04845,
  title  = {Simultaneous Speech-to-Speech Translation System with Neural Incremental ASR, MT, and TTS},
  author = {Katsuhito Sudoh and Takatomo Kano and Sashi Novitasari and Tomoya Yanagita and Sakriani Sakti and Satoshi Nakamura},
  journal= {arXiv preprint arXiv:2011.04845},
  year   = {2020}
}

备注

6 pages