可视化:同声语音翻译中被忽视的因素
计算与语言
2022-05-06 v2
摘要
同声语音翻译(SimulST)是在局部、增量语音输入上执行输出生成的任务。近年来,由于跨语言应用场景(如国际直播会议与流媒体讲座)的普及,SimulST 变得流行,其中实时语音翻译可便利用户对视听内容的获取。本文中,我们分析了迄今所开发的 SimulST 系统的特征,讨论其优势与不足。继而聚焦于恰当评估系统有效性所需的评价框架。为此,我们提出需开展更全面的性能分析,也包括用户体验视角。事实上,SimulST 系统不仅应根据质量/延迟度量评估,还应通过考虑例如所采用可视化策略的任务导向指标来评估。鉴于此,我们强调了社区已达成的目标与仍缺失之处。
引用
@article{arxiv.2111.00514,
title = {Visualization: the missing factor in Simultaneous Speech Translation},
author = {Sara Papi and Matteo Negri and Marco Turchi},
journal= {arXiv preprint arXiv:2111.00514},
year = {2022}
}
备注
Accepted at CLIC-it 2021