Hunyuan-MT 技术报告
计算与语言
2025-09-10 v2
摘要
本报告介绍 Hunyuan-MT-7B,这是我们的首个开源多语言翻译模型,支持 33 种主要语言之间的双向翻译,并特别强调中文与多种少数民族语言及方言之间的翻译。此外,为服务并应对多样化的翻译场景、提升模型在测试时的性能,我们引入 Hunyuan-MT-Chimera-7B,这是一种受慢思考模式启发的翻译模型。该模型整合了 Hunyuan-MT-7B 在不同参数设置下生成的多个输出,从而实现了优于基于思维链(Chain-of-Thought, CoT)的传统慢思考模型的性能。我们模型的开发遵循一个专为多语言翻译设计的整体训练流程,包括用于构建基础能力的通用与面向机器翻译的预训练、用于任务特定适应的监督微调(SFT),以及通过强化学习(RL)和弱到强 RL 进行的最终高级对齐。通过全面的实验,我们证明 Hunyuan-MT-7B 和 Hunyuan-MT-Chimera-7B 均显著优于所有同等参数规模的翻译专用模型和大多数 SOTA 大模型,特别是在中文与少数民族语言及方言之间的翻译任务上。在 WMT2025 共享任务(通用机器翻译)中,我们的模型展现出最先进的性能,在 31 个语言对中排名第一。该结果凸显了我们的模型在多样化语言谱系上的鲁棒性,涵盖中文、英语、日语等高资源语言,以及捷克语、马拉地语、爱沙尼亚语和冰岛语等低资源语言。
引用
@article{arxiv.2509.05209,
title = {Hunyuan-MT Technical Report},
author = {Mao Zheng and Zheng Li and Bingxin Qu and Mingyang Song and Yang Du and Mingrui Sun and Di Wang},
journal= {arXiv preprint arXiv:2509.05209},
year = {2025}
}