中文

翻译质量评估:人工与自动方法简述

计算与语言 2021-05-10 v1

摘要

为促成有效的翻译建模与翻译研究,亟需解决的关键问题之一是如何评估翻译质量。从准确性、可靠性、可重复性与成本角度看,翻译质量评估(TQA)本身是一项丰富且具挑战性的任务。本文中,我们对 TQA 方法进行高层且简洁的综述,涵盖人工判断准则与自动化评价指标,并将其进一步归类为更细致的子类别。我们希望本工作能成为翻译模型研究者与质量评估研究者的宝贵资源。此外,我们希望其能帮助从业者快速更好地理解传统 TQA 领域,并为其自身需求找到相应紧密相关的评估方案。除机器翻译(MT)外,本工作亦可启发其他自然语言处理(NLP)任务(如自动文本摘要(ATS)、自然语言理解(NLU)与自然语言生成(NLG))的质量评估与评价方法的进一步发展。

关键词

引用

@article{arxiv.2105.03311,
  title  = {Translation Quality Assessment: A Brief Survey on Manual and Automatic Methods},
  author = {Lifeng Han and Gareth J. F. Jones and Alan F. Smeaton},
  journal= {arXiv preprint arXiv:2105.03311},
  year   = {2021}
}

备注

Accepted to 23rd Nordic Conference on Computational Linguistics (NoDaLiDa 2021): Workshop on Modelling Translation: Translatology in the Digital Age (MoTra21). arXiv admin note: substantial text overlap with arXiv:1605.04515