HY-MT1.5 技术报告
计算与语言
2026-01-01 v1
摘要
在本报告中,我们介绍了最新的翻译模型 HY-MT1.5-1.8B 和 HY-MT1.5-7B,这是一个通过为高性能翻译量身定制的整体训练框架开发的新机器翻译模型系列。我们的方法编排了一个多阶段流程,该流程集成了通用和面向机器翻译的预训练、监督微调、在线策略蒸馏和强化学习。HY-MT1.5-1.8B,这个18亿参数的模型展示了卓越的参数效率,在标准的中-外和英-外任务中,全面超越了规模大得多的开源基线模型(例如 Tower-Plus-72B、Qwen3-32B)和主流商业API(例如 Microsoft Translator、Doubao Translator)。它达到了超大型专有模型(如 Gemini-3.0-Pro)约90%的性能,虽然在 WMT25 和普通话-少数民族语言基准测试中略逊于 Gemini-3.0-Pro,但相对于其他竞争模型仍保持显著领先。此外,HY-MT1.5-7B 在其规模级别上建立了新的最优水平,在 Flores-200 上达到了 Gemini-3.0-Pro 95%的性能,并在具有挑战性的 WMT25 和普通话-少数民族语言测试集上超越了它。除了标准翻译,HY-MT1.5 系列还支持高级约束,包括术语干预、上下文感知翻译和格式保留。广泛的实证评估证实,这两个模型在各自的参数规模内,为通用和专业翻译任务提供了极具竞争力且稳健的解决方案。
引用
@article{arxiv.2512.24092,
title = {HY-MT1.5 Technical Report},
author = {Mao Zheng and Zheng Li and Tao Chen and Mingyang Song and Di Wang},
journal= {arXiv preprint arXiv:2512.24092},
year = {2026}
}