中文

追踪关于 COVID-19 大流行的社交媒体话语:一个公开冠状病毒推文数据集的构建

社会与信息网络 2020-06-04 v2 种群与进化

摘要

在撰写本文时,新型冠状病毒(COVID-19)大流行的爆发已给全球许多国家的公民、资源和经济带来巨大压力。社交距离措施、旅行禁令、自我隔离和企业关闭正在改变全球社会的基本结构。随着人们被迫离开公共空间,关于这些现象的许多对话现在发生在线上,例如在 Twitter 等社交媒体平台上。在本文中,我们描述了一个多语言冠状病毒(COVID-19)Twitter 数据集,该数据集自 2020 年 1 月 22 日起由我们持续收集。我们正将该数据集提供给研究界(https://github.com/echen102/COVID-19-TweetIDs)。我们希望我们的贡献能够支持在空前规模和影响的行星级传染病爆发背景下研究在线对话动态。该数据集还可用于追踪科学性的冠状病毒错误信息和未经证实的谣言,或有助于理解恐惧与恐慌——无疑还有更多。最终,该数据集可能有助于形成知情的解决方案并制定有针对性的政策干预措施,以抗击这场全球危机。

关键词

引用

@article{arxiv.2003.07372,
  title  = {Tracking Social Media Discourse About the COVID-19 Pandemic: Development of a Public Coronavirus Twitter Data Set},
  author = {Emily Chen and Kristina Lerman and Emilio Ferrara},
  journal= {arXiv preprint arXiv:2003.07372},
  year   = {2020}
}