互联网声明数据集及其情感与可信度的比较
信息检索
2019-11-25 v1 计算与语言
摘要
在当今时代,通信已变得更快且更便捷。这意味着虚假信息可以如现实般迅速传播。考虑到假新闻对人们心理造成的损害以及此类新闻比真相传播更快的事实,我们需要研究助长假新闻传播的现象。构建用于分类的预测模型需要依赖于现实来评级新闻的无偏数据集。本文描述了创建此类数据集的方法。我们从事实核查机构 snopes.com 收集数据。此外,我们旨在创建该数据集不仅用于新闻分类,也用于找出解释虚假信息背后意图的模式。我们还正式定义了互联网声明、其可信度以及此类声明背后的情感。我们试图认识声明的情感与其可信度之间的关系。该关系为虚假信息传播背后的更大图景提供了启示。我们基于本文描述的数据集创建方法和预测建模的使用,以及基于人们心理/心态的研究,为理解假新闻为何比现实传播更快铺平了道路。
引用
@article{arxiv.1911.10130,
title = {A Data Set of Internet Claims and Comparison of their Sentiments with Credibility},
author = {Amey Parundekar and Susan Elias and Ashwin Ashok},
journal= {arXiv preprint arXiv:1911.10130},
year = {2019}
}
备注
8 pages, 6 figures, A paper accepted at the Truth Discovery and Fact Checking: Theory and Practice SIGKDD 2019 Workshop, August 5th, Anchorage, Alaska