中文

IT5:面向意大利语理解与生成的文本到文本预训练

计算与语言 2024-05-21 v2

摘要

我们介绍 IT5,首个专门在意大利语上预训练的编码器-解码器 Transformer 模型族。我们记录并对大型意大利语语料库执行了彻底的清洗流程,并用其预训练了四种规模的 IT5 模型。随后我们引入 ItaGen 基准,其包含广泛的意大利语自然语言理解与生成任务,并用它评估 IT5 模型与多语言基线的性能。我们发现单语 IT5 模型在所测模型中提供最佳的规模-性能比,一致优于其多语言对应模型,并为意大利语语言生成确立了新的 state-of-the-art。

关键词

引用

@article{arxiv.2203.03759,
  title  = {IT5: Text-to-text Pretraining for Italian Language Understanding and Generation},
  author = {Gabriele Sarti and Malvina Nissim},
  journal= {arXiv preprint arXiv:2203.03759},
  year   = {2024}
}

备注

LREC-COLING 2024. Code and checkpoints: https://github.com/gsarti/it5