中文

探寻可信新闻

计算与语言 2019-11-20 v1 人工智能 信息检索

摘要

我们研究识别线上虚假新闻的问题。这是一个重要问题,因为近年来可信度存疑的新闻在社交媒体上以惊人的规模扩散。由于这是一个研究不足的问题,尤其对于英语以外的语言,我们首先收集并向研究界发布了源自四个线上来源的三个新的平衡可信与虚假新闻数据集。随后我们提出一种语言无关的方法,基于丰富的特征集自动区分可信新闻与虚假新闻。具体而言,我们使用语言特征(n-gram)、可信度相关特征(大小写、标点、代词使用、情感极性)以及语义特征(词嵌入与DBPedia数据)。我们在三个不同测试集上的实验表明,我们的模型能以非常高准确率区分可信与虚假新闻。

关键词

引用

@article{arxiv.1911.08125,
  title  = {In Search of Credible News},
  author = {Momchil Hardalov and Ivan Koychev and Preslav Nakov},
  journal= {arXiv preprint arXiv:1911.08125},
  year   = {2019}
}

备注

Credibility, veracity, fact checking, humor detection