估计流水线式口语翻译系统的性能
cmp-lg
2008-02-03 v1 计算与语言
摘要
迄今为止开发的大多数口语翻译系统依赖于流水线体系结构,其中主要阶段包括语音识别、语言分析、transfer、生成和语音合成。在对此类系统进行误差率预测时,自然的假设是各个组件的误差率是相互独立的,从而使系统准确率为各组件准确率的乘积。本文报告了使用 SRI-SICS-Telia Research Spoken Language Translator 进行的实验,以及针对 1000 句话子样本的实验结果。结果表明,简单的数独性能模型会严重高估系统误差率,因为实际上各组件之间存在强烈的依赖关系。在独立假设下,通过简单相乘预测系统误差率,导致所有话语的误差率高估 16%,仅考虑 1-10 词长度的话语时,误差率高估 19%。
引用
@article{arxiv.cmp-lg/9407009,
title = {Estimating Performance of Pipelined Spoken Language Translation Systems},
author = {Manny Rayner and David Carter and Patti Price and Bertil Lyberg},
journal= {arXiv preprint arXiv:cmp-lg/9407009},
year = {2008}
}
备注
10 pages, Latex source. To appear in Proc. ICSLP '94