同声翻译与自动字幕的直接模型:FBK@IWSLT2023
计算与语言
2023-10-19 v1 人工智能
声音
音频与语音处理
摘要
本文描述了 FBK 参与 IWSLT 2023 评测活动的同声翻译与自动字幕赛道。我们的提交聚焦于使用直接架构来执行这两项任务:对于同声翻译任务,我们利用离线训练模型已获取的知识并直接应用策略以获得实时推理;对于字幕任务,我们调整直接 ST 模型以生成格式良好的字幕,并利用相同架构生成视听内容字幕同步所需的时间戳。我们的英德 SimulST 系统相比该任务 2021 和 2022 轮次中排名靠前的系统展现出更低的计算感知延迟,BLEU 提升高达 3.5。我们的自动字幕系统在英德和英西方向上分别比唯一已有的基于直接系统的方案高出 3.7 和 1.7 SubER。
引用
@article{arxiv.2309.15554,
title = {Direct Models for Simultaneous Translation and Automatic Subtitling: FBK@IWSLT2023},
author = {Sara Papi and Marco Gaido and Matteo Negri},
journal= {arXiv preprint arXiv:2309.15554},
year = {2023}
}
备注
Published at IWSTL 2023