中文

估计流水线式口语翻译系统的性能

cmp-lg 2008-02-03 v1 计算与语言

摘要

迄今为止开发的大多数口语翻译系统依赖于流水线体系结构,其中主要阶段包括语音识别、语言分析、transfer、生成和语音合成。在对此类系统进行误差率预测时,自然的假设是各个组件的误差率是相互独立的,从而使系统准确率为各组件准确率的乘积。本文报告了使用 SRI-SICS-Telia Research Spoken Language Translator 进行的实验,以及针对 1000 句话子样本的实验结果。结果表明,简单的数独性能模型会严重高估系统误差率,因为实际上各组件之间存在强烈的依赖关系。在独立假设下,通过简单相乘预测系统误差率,导致所有话语的误差率高估 16%,仅考虑 1-10 词长度的话语时,误差率高估 19%。

关键词

引用

@article{arxiv.cmp-lg/9407009,
  title  = {Estimating Performance of Pipelined Spoken Language Translation Systems},
  author = {Manny Rayner and David Carter and Patti Price and Bertil Lyberg},
  journal= {arXiv preprint arXiv:cmp-lg/9407009},
  year   = {2008}
}

备注

10 pages, Latex source. To appear in Proc. ICSLP '94