使用基于多语言 Transformer 的模型摘要印度语言
计算与语言
2023-03-30 v1
摘要
随着 mBART、mT5、IndicBART 等多语言模型的出现,低资源印度语言的摘要任务近来受到大量关注。但数据集的数量仍然较少。在这项工作中,我们(HakunaMatata 团队)研究了这些多语言模型在源文本和目标文本均为印度语言并执行摘要的数据集上的表现。我们使用 IndicBART 和 mT5 模型进行实验,并报告 ROUGE-1、ROUGE-2、ROUGE-3 和 ROUGE-4 分数作为性能指标。
引用
@article{arxiv.2303.16657,
title = {Summarizing Indian Languages using Multilingual Transformers based Models},
author = {Dhaval Taunk and Vasudeva Varma},
journal= {arXiv preprint arXiv:2303.16657},
year = {2023}
}