集体记忆的诞生:在线文本流中新兴实体分析
信息检索
2020-04-28 v2 计算与语言
摘要
我们研究集体记忆如何在线形成。为此,我们跟踪在公共话语(即社交媒体和新闻流等在线文本流)中出现的实体,在它们被纳入维基百科之前;我们认为维基百科可视为集体记忆的在线场所。通过跟踪实体在公共话语中出现的模式,即其首次在在线文本流中被提及与后续纳入集体记忆之间的时间模式,我们深入了解了在线集体记忆过程是如何发生的。具体而言,我们分析了近80,000个实体,它们在被纳入维基百科之前于在线文本流中出现。我们用于分析的在线文本流包括社交媒体和新闻流,跨度超过5.79亿文档,时间跨度为18个月。我们发现两种主要出现模式:以“突发(bursty)”方式出现的实体,即在没有先例的情况下出现在公共话语中,爆发活跃并转入集体记忆。其他实体显示“延迟(delayed)”模式,它们出现在公共话语中,经历一段不活跃期,然后在转入我们的文化集体记忆之前重新浮现。
引用
@article{arxiv.1701.04039,
title = {The Birth of Collective Memories: Analyzing Emerging Entities in Text Streams},
author = {David Graus and Daan Odijk and Maarten de Rijke},
journal= {arXiv preprint arXiv:1701.04039},
year = {2020}
}
备注
To appear in JASIST