端到端语音翻译中由不流畅语音到流畅译文的转换
计算与语言
2019-06-04 v1
摘要
语音翻译应用在口语语音现象下表现不佳,尤其受不流畅现象的影响。随着端到端语音翻译模型的兴起,诸如不流畅去除等原先位于语音识别与机器翻译之间的中间处理步骤,需要被整合进模型架构中。我们使用序列到序列模型,基于近期为 Fisher 西班牙-英语数据集收集的“校对后”参考译文,从含噪声且不流畅的语音直接生成去除了不流畅现象的流畅文本。我们能够直接生成流畅的翻译,并提出关于如何评估该任务成效的若干考量。本工作为一个新任务——在去除不流畅现象的同时翻译对话语音——提供了基线。
引用
@article{arxiv.1906.00556,
title = {Fluent Translations from Disfluent Speech in End-to-End Speech Translation},
author = {Elizabeth Salesky and Matthias Sperber and Alex Waibel},
journal= {arXiv preprint arXiv:1906.00556},
year = {2019}
}
备注
Accepted at NAACL 2019