MeMAD 团队在 IWSLT 2018 语音翻译任务上的提交
计算与语言
2018-10-25 v1
摘要
本文描述了 MeMAD 项目在 IWSLT 语音翻译共享任务中的参赛系统,该任务面向英语音频到德语文本的翻译。在流水线模型与端到端模型两条赛道中,我们仅参与了前者,提交了三套对比系统。我们也尝试了后者,但未能及时完成端到端模型。我们的所有系统均首先通过训练于 TED-LIUM 英语语音识别语料库(TED-LIUM)的自动语音识别(ASR)模型将音频转写为文本。随后,我们将转写文本输入基于英语-德语文本的神经网络机器翻译(NMT)模型。我们的系统采用了三个不同的翻译模型,分别训练于由 TED 语音翻译语料库的英德部分(TED-Trans)与 OPUS 语料库的 OpenSubtitles2018 子集编译而成的独立训练集。本文还描述了导向最终系统的实验过程。实验表明,在训练中使用 OpenSubtitles2018 显著提升了翻译性能。我们也尝试了 NMT 模块的各种前处理与后处理流程,但收效甚微。我们得分最高的系统在本年度任务测试集上取得了 16.45 的 BLEU 分数。
引用
@article{arxiv.1810.10320,
title = {The MeMAD Submission to the IWSLT 2018 Speech Translation Task},
author = {Umut Sulubacak and Jörg Tiedemann and Aku Rouhe and Stig-Arne Grönroos and Mikko Kurimo},
journal= {arXiv preprint arXiv:1810.10320},
year = {2018}
}
备注
Submitted to IWSLT 2018