中文

谁说的?电视新闻的自动文本内容分析

计算与语言 2013-08-30 v2 信息检索

摘要

我们基于伴随电视新闻节目的隐藏字幕,对其进行了自动分析。具体而言,我们收集了六个月期间美国超过 140 个电视频道播出的所有新闻。我们首先对隐藏字幕进行自动分割、处理和标注。接下来,我们利用自然语言处理 (NLP) 方法重点分析其语言风格及对人物的提及。我们提出了一系列关于新闻提供者及新闻人物的关键见解,并讨论了可通过自动手段揭示的偏见。通过从多个视角(包括定性评估)审视数据,对这些见解进行了对比分析。

关键词

引用

@article{arxiv.1307.4879,
  title  = {Says who? Automatic Text-Based Content Analysis of Television News},
  author = {Carlos Castillo and Gianmarco De Francisci Morales and Marcelo Mendoza and Nasir Khan},
  journal= {arXiv preprint arXiv:1307.4879},
  year   = {2013}
}

备注

In the 2013 workshop on Mining Unstructured Big Data Using Natural Language Processing, co-located with CIKM 2013