DIETA:一种用于意大利语-英语机器翻译的仅解码器Transformer模型
计算与语言
2026-01-27 v1 人工智能
摘要
在本文中,我们介绍了DIETA,一个具有5亿参数的小型、仅解码器Transformer模型,专门为意大利语-英语机器翻译设计和训练。我们收集并整理了一个大型平行语料库,包含约2.07亿个涵盖不同领域(包括议会记录、法律文本、网络爬取内容、字幕、新闻、文学)的意大利语-英语句子对,以及使用预训练模型生成的3.52亿个反向翻译数据。此外,我们基于2025年WikiNews文章创建并发布了一个新的小规模评估集,包含450个句子,能够评估在当代文本上的翻译质量。全面评估表明,DIETA在多个意大利语-英语基准测试中取得了有竞争力的性能,在包含32个系统的排行榜中稳定处于第二四分位数,并在五个测试套件中的四个上优于大多数其他小于30亿参数的模型。训练脚本、训练好的模型、整理的语料库以及新引入的评估集均已公开提供,以促进专门化意大利语-英语机器翻译的进一步研究和发展。https://github.com/pkasela/DIETA-Machine-Translation
引用
@article{arxiv.2601.17823,
title = {DIETA: A Decoder-only transformer-based model for Italian-English machine TrAnslation},
author = {Pranav Kasela and Marco Braga and Alessandro Ghiotto and Andrea Pilzer and Marco Viviani and Alessandro Raganato},
journal= {arXiv preprint arXiv:2601.17823},
year = {2026}
}
备注
Published in CLiC-IT '25: https://aclanthology.org/2025.clicit-1.52/