中文

面向短语翻译过程识别的研究:基于英法双语的实验

计算与语言 2019-04-30 v1

摘要

在翻译短语(单词或词组)时,人类译者会有意识或无意识地采用除直译外的不同翻译过程,如习语对等、泛化、特化、语义调制等。译者和语言学家(如 Vinay 与 Darbelnet、Newmark 等)已提出若干类型学来刻画不同的翻译过程。然而,据我们所知,尚未有自动分类这些细粒度翻译过程的尝试。最近,一个英法双语 TED 演讲平行语料库已被人工标注了翻译过程类别及既定标注指南。基于这些标注样例,我们提出了子句层面的翻译过程自动分类。实验结果显示,我们能以 87.09% 的准确率区分非直译与直译,并在五种非直译过程分类中达到 55.20% 的准确率。本工作表明自动分类翻译过程是可行的。即便标注样例较少,我们的实验也指出了未来工作可遵循的方向。我们的长期目标之一是借助该自动分类更好地控制从双语平行语料库中提取释义。

关键词

引用

@article{arxiv.1904.12213,
  title  = {Towards Recognizing Phrase Translation Processes: Experiments on English-French},
  author = {Yuming Zhai and Pooyan Safari and Gabriel Illouz and Alexandre Allauzen and Anne Vilnat},
  journal= {arXiv preprint arXiv:1904.12213},
  year   = {2019}
}

备注

12 pages, preprint version accepted to the conference CICLING 2019