面向多语言机器翻译的开放大型语言模型模型与数据扩展
计算与语言
2026-02-26 v2
摘要
开放式大型语言模型(LLM)近年来在多语言能力方面取得了改善。本文present了一项针对开放 LLM 的多语言机器翻译(MT)研究,探讨了模型规模和数据规模对开放 LLM 通过持续预训练和指令微调进行多语言 MT 适应效果的影响。基于 Gemma3 模型系列,我们开发了 MiLMMT-46,实现了跨 46 种语言的顶级多语言翻译性能。大量实验表明,MiLMMT-46 在各项指标上一致优于最新 SOTA 模型,包括 Seed-X、HY-MT-1.5 和 TranslateGemma,同时与 Google Translate 和 Gemini 3 Pro 等强大专有系统取得了具竞争力的性能。模型已发布于 https://huggingface.co/collections/xiaomi-research/milmmt-46。代码已发布于 https://github.com/xiaomi-research/gemmax。
引用
@article{arxiv.2602.11961,
title = {Scaling Model and Data for Multilingual Machine Translation with Open Large Language Models},
author = {Yuzhe Shang and Pengzhi Gao and Wei Liu and Jian Luan and Jinsong Su},
journal= {arXiv preprint arXiv:2602.11961},
year = {2026}
}