谁说的?电视新闻的自动文本内容分析
计算与语言
2013-08-30 v2 信息检索
摘要
我们基于伴随电视新闻节目的隐藏字幕,对其进行了自动分析。具体而言,我们收集了六个月期间美国超过 140 个电视频道播出的所有新闻。我们首先对隐藏字幕进行自动分割、处理和标注。接下来,我们利用自然语言处理 (NLP) 方法重点分析其语言风格及对人物的提及。我们提出了一系列关于新闻提供者及新闻人物的关键见解,并讨论了可通过自动手段揭示的偏见。通过从多个视角(包括定性评估)审视数据,对这些见解进行了对比分析。
引用
@article{arxiv.1307.4879,
title = {Says who? Automatic Text-Based Content Analysis of Television News},
author = {Carlos Castillo and Gianmarco De Francisci Morales and Marcelo Mendoza and Nasir Khan},
journal= {arXiv preprint arXiv:1307.4879},
year = {2013}
}
备注
In the 2013 workshop on Mining Unstructured Big Data Using Natural Language Processing, co-located with CIKM 2013