面向自动文学翻译评估的两步框架:其承诺与局限
计算与语言
2025-09-15 v3
摘要
本文提出并评估了一种以两阶段管道进行文学机器翻译评估的可行性,方法是从英文到韩文进行细粒度评估。结果表明,我们的框架提供了适用于文学翻译的细粒度、可解释的指标,并且与人类判断的相关性高于传统机器翻译指标。然而,它仍未能匹配人类间的一致性,尤其是在韩语敬语等指标方面。我们还观察到 LLMs 倾向于偏好其他 LLMs 生成的翻译,我们强调需要更精细的评估方法,以确保文学作品的准确且符合文化规范的机器翻译。
引用
@article{arxiv.2412.01340,
title = {A 2-step Framework for Automated Literary Translation Evaluation: Its Promises and Pitfalls},
author = {Sheikh Shafayat and Dongkeun Yoon and Woori Jang and Jiwoo Choi and Alice Oh and Seohyon Jung},
journal= {arXiv preprint arXiv:2412.01340},
year = {2025}
}