基于知识图谱视角的多文档科学摘要生成
计算与语言
2022-09-12 v1 人工智能
摘要
多文档科学摘要生成(MDSS)旨在为成簇的主题相关科学论文生成连贯且简洁的摘要。该任务需要对论文内容有精确理解并对跨论文关系进行准确建模。知识图谱为文档传达紧凑且可解释的结构化信息,这使其非常适合内容建模与关系建模。在本文中,我们提出 KGSum,一种在编码与解码过程中均以知识图谱为中心的 MDSS 模型。具体而言,在编码过程中,提出两个基于图的模块将知识图谱信息融入论文编码;而在解码过程中,我们提出一个两阶段解码器,先以描述性句子的形式生成摘要的知识图谱信息,随后生成最终摘要。实证结果表明,所提架构在 Multi-Xscience 数据集上相较基线带来了实质性改进。
引用
@article{arxiv.2209.04319,
title = {Multi-Document Scientific Summarization from a Knowledge Graph-Centric View},
author = {Pancheng Wang and Shasha Li and Kunyuan Pang and Liangliang He and Dong Li and Jintao Tang and Ting Wang},
journal= {arXiv preprint arXiv:2209.04319},
year = {2022}
}
备注
Accepted by COLING 2022