利用 ParsBERT 与预训练 mT5 进行波斯语抽取式文本摘要
计算与语言
2021-05-11 v1
摘要
文本摘要是最关键的自然语言处理(NLP)任务之一。该领域每日都有越来越多研究开展。基于预训练 Transformer 的编码器-解码器模型已开始在这些任务中受到青睐。本文提出两种方法解决该任务,并引入一个名为 pn-summary 的波斯语抽取式文本摘要新数据集。本文所用的模型为 mT5 与 ParsBERT 模型(即波斯语单语 BERT 模型)的编码器-解码器版本。这些模型在 pn-summary 数据集上进行了微调。当前工作是同类中的首个,并通过取得有前景的结果,可作为未来任何工作的基线。
引用
@article{arxiv.2012.11204,
title = {Leveraging ParsBERT and Pretrained mT5 for Persian Abstractive Text Summarization},
author = {Mehrdad Farahani and Mohammad Gharachorloo and Mohammad Manthouri},
journal= {arXiv preprint arXiv:2012.11204},
year = {2021}
}
备注
7 pages, 7 figures, 3 tables, csicc2021 conference