基于字幕与剧本的电影和纪录片摘要生成
计算与语言
2016-03-10 v3 人工智能
信息检索
摘要
我们以新闻文章摘要的已知表现为参照,评估了应用于电影和纪录片的通用文本摘要算法的性能。我们使用了三个数据集:(i) 新闻文章,(ii) 电影剧本与字幕,以及 (iii) 纪录片字幕。标准 ROUGE 度量用于将被生成的摘要与新闻摘要、情节概要和简介进行比较。我们表明,表现最佳的算法对于新闻文章和纪录片是 LSA,而对于电影则是 LexRank 和 Support Sets。尽管电影和纪录片性质不同,它们的相对表现与新闻文章所得结果一致。
引用
@article{arxiv.1506.01273,
title = {Summarization of Films and Documentaries Based on Subtitles and Scripts},
author = {Marta Aparício and Paulo Figueiredo and Francisco Raposo and David Martins de Matos and Ricardo Ribeiro and Luís Marujo},
journal= {arXiv preprint arXiv:1506.01273},
year = {2016}
}
备注
7 pages, 9 tables, 4 figures, submitted to Pattern Recognition Letters (Elsevier)