中文

基于字幕与剧本的电影和纪录片摘要生成

计算与语言 2016-03-10 v3 人工智能 信息检索

摘要

我们以新闻文章摘要的已知表现为参照,评估了应用于电影和纪录片的通用文本摘要算法的性能。我们使用了三个数据集:(i) 新闻文章,(ii) 电影剧本与字幕,以及 (iii) 纪录片字幕。标准 ROUGE 度量用于将被生成的摘要与新闻摘要、情节概要和简介进行比较。我们表明,表现最佳的算法对于新闻文章和纪录片是 LSA,而对于电影则是 LexRank 和 Support Sets。尽管电影和纪录片性质不同,它们的相对表现与新闻文章所得结果一致。

关键词

引用

@article{arxiv.1506.01273,
  title  = {Summarization of Films and Documentaries Based on Subtitles and Scripts},
  author = {Marta Aparício and Paulo Figueiredo and Francisco Raposo and David Martins de Matos and Ricardo Ribeiro and Luís Marujo},
  journal= {arXiv preprint arXiv:1506.01273},
  year   = {2016}
}

备注

7 pages, 9 tables, 4 figures, submitted to Pattern Recognition Letters (Elsevier)